MiMo-V2.5:完整規格、定價、API 存取與應用場景(2026)
MiMo-V2.5 是小米推出的一款多模態、面向智慧型體的模型,專為程式設計、長上下文分析及融合文字、視覺或音訊資訊的工作流程所設計。該模型於2026年4月22日發表,採用稀疏專家混合架構,支援最高達100萬上下文 token。本指南將梳理該模型的官方能力、Gate.AI 公布的定價、支援的多模態類型、運作權衡、實際應用場景,以及截至2026年7月經驗證的 API 接入方式。
什麼是 MiMo-V2.5?
MiMo-V2.5 是小米研發的一款擁有3100億參數的稀疏專家混合模型。推論時實際啟用參數約為150億,這意味著模型雖然架構龐大,但每個 token 僅需激活部分參數。
小米將該模型定位為集智慧型體執行、程式設計與多模態推理於一體的統一系統。其語言主幹結合專用的視覺和音訊編碼器,使其能夠處理文字、圖像、音訊及影片資訊,而非僅限於文字。小米亦表示,經過指令微調的版本支援最高100萬 token 的上下文視窗。
MiMo-V2.5 與 MiMo-V2.5 Pro 在定位與規模上有所不同。標準版總參數為3100億,啟用參數為150億,而 Pro 版則擁有1.02兆總參數和420億啟用參數。因此,標準版更著重於多模態能力與智慧型體效能的成本效益平衡。
MiMo-V2.5 的核心參數與定價如何?
| 規格 | 經驗證或官方數據 |
|---|---|
| 服務商 | 小米 |
| 發布時間 | 2026年4月22日 |
| 架構 | 稀疏專家混合 |
| 總參數量 | 3100億 |
| 啟用參數量 | 150億 |
| 上下文視窗 | 最高100萬 token |
| 訓練 token 數 | 48萬億 |
| Gate.AI 模型ID | xiaomi/mimo-v2.5 |
| Gate.AI 輸入價格 | 每100萬 token $0.14 |
| Gate.AI 輸出價格 | 每100萬 token $0.28 |
| Gate.AI 快取讀取價格 | 每100萬 token $0.0428 |
| 快取寫入價格 | 未公布 |
| 輸入類型 | 文字、圖像、音訊、影片 |
| 主要輸出 | 文字 |
小米官方確認了架構、參數量、訓練 token 數、上下文視窗及多模態設計。模型ID與 token 定價由 Gate.AI 單獨公布,不代表小米官方 API 價格。
例如,若一次請求包含200萬未快取輸入 token 和50萬輸出 token,預估費用為:
(2 × $0.14) + (0.5 × $0.28) = $0.42
此計算未包含快取折扣、重試、帳戶專屬條款及其他可能費用。
MiMo-V2.5 在生產環境中的核心價值體現在哪裡?
MiMo-V2.5 的生產力優勢在於將長上下文處理、程式設計能力與多模態理解集於一身。
例如,軟體智慧型體可在提出修復建議前,綜合分析原始碼、技術文件、介面截圖與錯誤日誌,無需分別將視覺資訊和程式碼傳送至不同模型。小米亦將 MiMo-V2.5 定位於多步驟、工具調用及長時上下文的智慧型體任務。
其100萬 token 上下文視窗可容納大型程式碼庫、長文件或大量互動歷史。但每次請求都提交最大上下文可能導致成本與處理時間增加,因此檢索、文件篩選與上下文壓縮依然有其現實意義。
該模型亦可解析錄製的示範或支援會話。例如,將語音回饋與介面操作對應,並自動產生結構化的缺陷報告。這類工作流程仰賴多模態理解;但目前無文件顯示 MiMo-V2.5 原生支援圖像、音訊或影片生成。
MiMo-V2.5 支援哪些多模態類型?
| 模態 | 輸入 | 輸出 | 實際應用場景 |
|---|---|---|---|
| 文字 | 支援 | 支援 | 分析、程式設計、摘要與指令 |
| 圖像 | 支援 | 未確認 | 截圖、圖表、文件與視覺推理 |
| 音訊 | 支援 | 未確認 | 語音與聲音理解 |
| 影片 | 支援 | 未確認 | 錄製流程與時序分析 |
| 程式碼 | 支援 | 支援 | 產生、除錯與程式碼庫審查 |
小米官方明確文件化了對視覺和音訊的原生理解,並介紹了模型在圖像、影片及多模態智慧型體任務中的表現。公開資料顯示,文字生成是主要輸出,暫未確認可直接生成原生媒體內容。
MiMo-V2.5 有哪些限制?
透過 Gate.AI 路由,部分運作細節尚未公開確認,包括最大輸出長度、速率限制、微調支援、媒體上傳要求及模型特定結構化輸出行為。
大上下文視窗也可能導致提示詞使用效率低落。直接提交整個程式碼庫,成本較高且結果未必聚焦,不如僅檢索相關文件。
多模態請求可能包含人臉、對話、客戶資訊、原始碼或憑證。團隊應於傳送敏感資訊前,做好去識別化、存取控制與資料留存策略。
由智慧型體生成的程式碼與工具操作需額外防護。輸出結果應經自動化測試、相依檢查與人工審核,工具權限應遵循最小權限原則。
MiMo-V2.5 適合哪些應用場景?
MiMo-V2.5 特別適用於:
- 融合原始碼、截圖或日誌的程式設計助手;
- 長文件與程式碼庫分析;
- 多模態除錯與介面審查;
- 錄製流程或產品示範分析;
- 對成本敏感、需廣泛輸入支援的智慧型體。
當工作流程需要多種輸入模態、長上下文及較低 token 定價時,建議選擇 MiMo-V2.5。若任務需原生媒體生成、極高專業度程式設計、嚴格結構化輸出或完整企業級管控,則建議考慮其他模型。
MiMo-V2.5 與 MiMo-V2.5 Pro 及 Gemini 2.5 Flash 對比如何?
| 對比維度 | MiMo-V2.5 | MiMo-V2.5 Pro | Gemini 2.5 Flash |
|---|---|---|---|
| 主要定位 | 高效多模態智慧型體 | 複雜程式設計與長週期智慧型體 | 通用多模態應用 |
| 總參數量 | 3100億 | 1.02兆 | 未公開 |
| 啟用參數量 | 150億 | 420億 | 未公開 |
| 上下文視窗 | 100萬 token | 100萬 token | 視平台而定 |
| 多模態輸入 | 文字、圖像、音訊、影片 | 需驗證具體路由 | 多模態 |
| 主要決策因素 | 成本與多模態廣度 | 更高端智慧型體效能 | Google 生態整合 |
MiMo-V2.5 是小米面向 token 效率與多模態理解的實用選擇。MiMo-V2.5 Pro 更適合高需求的軟體工程及長週期任務。
Gemini 2.5 Flash 適合已採用 Google 模型生態的團隊。模型選擇應基於已驗證的 API 功能、任務品質、延遲及整體會話成本,而非僅關注上下文視窗大小。
如何透過 Gate.AI 存取 MiMo-V2.5?
Gate.AI 提供相容 OpenAI 的 API,基礎 URL 為 https://api.gate.ai/openai/v1。根據 Gate.AI 公告,模型識別為 xiaomi/mimo-v2.5。
Python
import osfrom openai import OpenAIclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)try:response = client.chat.completions.create(model="xiaomi/mimo-v2.5",messages=[{"role": "user","content": "Review this Python service and identify reliability risks."}],)print(response.choices[0].message.content)except Exception as error:print(f"Request failed: {error}")
curl
curl "https://api.gate.ai/openai/v1/chat/completions" \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "xiaomi/mimo-v2.5","messages": [{"role": "user","content": "Create a migration plan for this Python service."}]}'
以上範例均採用 Gate.AI 公布的通用 chat-completions 路由。在實作圖像、音訊或影片請求前,請確認帳戶權限及現行媒體輸入規範。
常見問題解答
MiMo-V2.5 是否支援100萬 token 上下文視窗?
支援。小米官方文件明確指令微調版 MiMo-V2.5 支援最高100萬 token 的上下文視窗。
MiMo-V2.5 能處理影片和音訊嗎?
支援。小米文件顯示模型具備原生視覺與音訊理解能力,並在影片及多模態任務上進行了評測。
透過 Gate.AI 使用 MiMo-V2.5 的費用是多少?
根據 Gate.AI 公布,輸入每100萬 token 收費$0.14,輸出每100萬 token $0.28,快取讀取每100萬 token $0.0428。
MiMo-V2.5 適合用作程式設計智慧型體嗎?
適合。該模型專為程式設計與智慧型體工作流程設計,但產生的變更仍需經過測試、安全審查及人工確認。
MiMo-V2.5 是否比 MiMo-V2.5 Pro 更便宜?
Gate.AI 公布的定價顯示標準版為低成本選項。若需更高端軟體工程或更長週期自主流程,MiMo-V2.5 Pro 或許更為適合。


