小米發表了新一代大型語言模型系列MiMo-V2.6。該系列以參數規模超過兆級的旗艦版Pro為核心,同時提供多種規格,所有版本的權重皆以寬鬆的MIT授權條款免費釋出。第三方機構的評測顯示,該模型在開源權重模型中位居榜首,以相對有限的訓練成本達成頗高水準的效能,因此受到不少關注。

四款模型,共用同一套能力

該系列的核心是MiMo-V2.6-Pro,總參數量超過一兆,採用混合專家(MoE)架構,推論時僅會啟用其中一小部分參數。輕量版MiMo-V2.6-Flash的總參數量約為數千億規模,相較Pro運算負擔較輕。

此外,小米也發表了針對企業託管環境、回應速度更快的Pro-UltraSpeed版本(輸出速度最高提升20倍),以及供研究用途、參數量不到百億的蒸餾模型。Pro、Flash及Pro-UltraSpeed皆支援100萬token的上下文視窗,並可接收文字、圖片、音訊與影片作為輸入,不過目前輸出僅限文字。

內部採專家路由架構,並支援影像理解

Pro的內部結構由數十層Transformer模組組成,其中包含數百個路由專家,每個token僅會啟用其中少數幾個。該模型還配備了用於加速生成的推測解碼機制,以及專門處理影像輸入的視覺編碼器。

其注意力機制結合了僅關注局部範圍的滑動視窗注意力,以及少量能夠縱覽全文的全域注意力層。在部署方面,小米表示以全精度執行Pro大約需要8張高階GPU,而Flash所需數量約為一半,這為企業自行架設提供了參考依據。

公開訓練成本,凸顯性價比優勢

MiMo-V2.6備受矚目的一點,是其相對較低的訓練成本。小米表示,此次針對程式撰寫、通用代理任務、視覺推理以及資訊安全等多個領域,統一進行了一次大規模強化學習訓練,總花費約為350萬美元(約合5億5,300萬日圓)。訓練過程中採用了一種高效的強化學習演算法,以並行且非同步的方式大規模取樣提示詞,充分運用運算資源。小米還採取了直播訓練過程這種較為罕見的作法。

※1美元約合158日圓換算(截至2026年9月25日)

在第三方機構發布的綜合智慧指數排行榜中,Pro在開源權重模型中取得了最高分。其單一任務的推論成本也控制在1美元以內,展現出效能與成本之間的良好平衡。

多項基準測試逼近業界頂尖水準

在具體的技術基準測試中,該模型同樣表現不俗。在軟體開發能力、代理任務處理以及命令列操作等多項評測中,Pro的表現均優於輕量版Flash,兩者都展現出可實際應用的水準。在涉及複雜檔案操作以及資安相關的評測中,得分也相對較高。

不過也有報導指出,與海外頂尖閉源模型相比,Pro在部分指標上仍有若干差距。儘管如此,考量到其權重完全開放且訓練成本相對較低,MiMo-V2.6依然憑藉效能與開放性的結合,確立了自身獨特的市場定位。

提供管道多元,依token用量計費

MiMo-V2.6的權重已於Hugging Face上以MIT授權釋出,允許研究及商業用途使用。除此之外,該模型也可透過小米自有API以及多個第三方AI平台使用,方便開發者依自身環境彈性選擇串接方式。

透過第三方平台使用時,Pro的輸入價格為每百萬token不到1美元,輸出價格與之相當。更輕量的Flash價格更為低廉,而追求速度的Pro-UltraSpeed則相應地價格較高。部分開發者工具還在發表初期推出限時免費使用Flash模型的活動。

總結

小米此次發表的MiMo-V2.6系列,最大的亮點在於以約350萬美元的訓練成本,免費開源了達兆級參數規模的模型,並採用寬鬆的MIT授權。該模型在第三方評測中取得開源權重模型的最高分,展現出頗強的效能實力,同時提供從權重直接下載到多種API串接在內的多元使用方式。儘管在部分指標上仍略遜於海外頂尖閉源模型,但憑藉較低的開發成本與具競爭力的價格,MiMo-V2.6有望在日益激烈的開源AI模型競爭中,成為一個具吸引力的選擇。

參考來源
https://datanorth.ai/news/xiaomi-releases-mimo-v2-6-pro-and-flash