4月28日凌晨,小米技術(shù)官方宣布旗艦大模型MiMo-V2.5-Pro及全模態(tài)模型MiMo-V2.5正式全球開源。 該系列模型權(quán)重已全量開放于Hugging Face等平臺(tái),采用寬松的MIT協(xié)議,允許全球開發(fā)者自由商用、微調(diào)及二次訓(xùn)練,無(wú)需額外授權(quán)。與此同時(shí),小米推出MiMo Orbit計(jì)劃,宣布于30天內(nèi)面向全球開發(fā)者發(fā)放總計(jì)100萬(wàn)億免費(fèi)Token權(quán)益,并與OpenCode、Hermes Agent、KiloCode等Agent框架團(tuán)隊(duì)展開生態(tài)共建合作。

模型定位與技術(shù)架構(gòu):雙版本覆蓋Agent與全模態(tài)場(chǎng)景
MiMo-V2.5系列包含兩款模型,均支持100萬(wàn)Token超長(zhǎng)上下文窗口,但定位各有側(cè)重:
- MiMo-V2.5-Pro:旗艦Agent模型,面向復(fù)雜任務(wù)場(chǎng)景,深度適配Agent與Coding應(yīng)用。據(jù)小米公布的模型卡,該模型為擁有1.02萬(wàn)億(1.02T)總參數(shù)、420億(42B)激活參數(shù)的混合專家(MoE)架構(gòu),基于混合注意力架構(gòu)設(shè)計(jì)。其預(yù)訓(xùn)練使用了27萬(wàn)億Token,采用FP8混合精度,原生序列長(zhǎng)度32K,后擴(kuò)展至1M Token。技術(shù)細(xì)節(jié)上,局部滑動(dòng)窗口注意力(SWA)與全局注意力(GA)以6:1比例交錯(cuò)使用,窗口大小為128 Token;同時(shí)繼承并優(yōu)化了多標(biāo)記預(yù)測(cè)(MTP)機(jī)制,通過(guò)輕量級(jí)密集前饋神經(jīng)網(wǎng)絡(luò)模塊,將輸出吞吐量提升約三倍。

- MiMo-V2.5:原生全模態(tài)模型,支持文本、圖像、視頻和音頻理解,具備強(qiáng)大的Agent能力。該模型為3100億(310B)總參數(shù)、150億(15B)激活參數(shù)的稀疏MoE模型,在48萬(wàn)億Token上完成預(yù)訓(xùn)練。其語(yǔ)言主干繼承混合滑動(dòng)窗口注意力機(jī)制,并搭載自研預(yù)訓(xùn)練視覺(jué)與音頻編碼器,通過(guò)輕量化投影模塊實(shí)現(xiàn)跨模態(tài)融合。

在后訓(xùn)練階段,MiMo-V2.5-Pro遵循三階段范式:監(jiān)督式微調(diào)建立基礎(chǔ)指令跟蹤能力;領(lǐng)域?qū)>?xùn)練通過(guò)強(qiáng)化學(xué)習(xí)分別優(yōu)化數(shù)學(xué)、安全、智能工具使用等能力;最終通過(guò)多教師策略蒸餾(MOPD)將各領(lǐng)域能力融合至統(tǒng)一模型。MiMo-V2.5則經(jīng)歷五階段訓(xùn)練,涵蓋文本預(yù)訓(xùn)練、投影層預(yù)熱、多模態(tài)預(yù)訓(xùn)練、上下文逐步擴(kuò)容(32K→256K→1M)以及強(qiáng)化學(xué)習(xí)與多目標(biāo)偏好蒸餾。
基準(zhǔn)測(cè)試表現(xiàn):多項(xiàng)榜單登頂,對(duì)標(biāo)全球頂級(jí)閉源模型
根據(jù)小米官方公布的Benchmark Results及多家媒體報(bào)道,MiMo-V2.5系列在多項(xiàng)權(quán)威測(cè)評(píng)中表現(xiàn)突出:

GDPVal-AA(Elo):MiMo-V2.5-Pro以1581分、MiMo-V2.5以1559分位列全球開源模型第一;
Claw-Eval(pass^3):MiMo-V2.5-Pro以63.8%位列全球開源模型第一,在任務(wù)完成率與Token效率維度上處于最優(yōu)前沿;
t³-bench:MiMo-V2.5-Pro得分72.9,全球開源第一;
SWE-bench Pro:MiMo-V2.5-Pro得分57.2,超過(guò)DeepSeek V4 Pro的55.4與Gemini 3.1 Pro的54.2;
MiMo Coding Bench:MiMo-V2.5-Pro得分73.7,領(lǐng)先于Gemini 3.1 Pro的67.8;
Terminal-Bench 2.0:MiMo-V2.5-Pro得分68.4,優(yōu)于MiMo-V2-Pro的57.1與DeepSeek V4 Pro的67.9。

在Artificial Analysis綜合智能指數(shù)榜單中,MiMo-V2.5-Pro發(fā)布當(dāng)天即位列全球開源大模型并列第一,同時(shí)Agent專項(xiàng)指數(shù)開源第一,躋身全球所有大模型(含閉源)總榜前五。小米方面指出,在通用智能體能力、復(fù)雜軟件工程以及長(zhǎng)程任務(wù)等核心維度上,MiMo-V2.5-Pro已可對(duì)標(biāo)Claude Opus 4.6、GPT-5.4等全球頂級(jí)Agent模型,且推理成本僅為國(guó)際閉源旗艦的2.5%。

值得注意的是,智東西等媒體報(bào)道稱,MiMo-V2.5-Pro在GDPVal-AA、Claw-Eval、t³-bench等多項(xiàng)測(cè)評(píng)中超過(guò)了最新開源的DeepSeek-V4-Pro模型,也超過(guò)了Kimi K2.6等主流閉源模型。


國(guó)產(chǎn)芯片與推理框架Day 0適配:開源即部署
MiMo-V2.5-Pro于開源首日即完成與多家國(guó)內(nèi)外主流芯片廠商的深度適配,實(shí)現(xiàn)了"開源即部署"的產(chǎn)業(yè)落地能力:

此外,MiMo-V2.5系列模型同步完成了SGLang與vLLM兩大主流推理框架的Day 0適配,確保開發(fā)者可在開源首日即時(shí)投入生產(chǎn)級(jí)部署。小米集團(tuán)副總裁屈恒此前在小米投資者日活動(dòng)中透露,MiMo-V2.5系列"適配國(guó)內(nèi)外多家主流推理芯片,其中幾乎覆蓋所有國(guó)產(chǎn)推理芯片"。

MiMo Orbit計(jì)劃:百萬(wàn)億Token激勵(lì)與Agent生態(tài)共建
為降低開發(fā)者使用門檻并快速擴(kuò)大生態(tài),小米同步推出MiMo Orbit計(jì)劃,包含兩大組件:
- 百萬(wàn)億Token創(chuàng)造者激勵(lì)計(jì)劃:面向全球AI用戶,于北京時(shí)間2026年4月28日00:00至5月28日00:00的30天內(nèi),發(fā)放總計(jì)100萬(wàn)億(100T)免費(fèi)Token權(quán)益,贈(zèng)完即止。該計(jì)劃采取申請(qǐng)制,通過(guò)審核的用戶最高可獲得Max檔位的Token Plan,包含16億Credits,官方標(biāo)注價(jià)值659元。申請(qǐng)通道為100t.xiaomimimo.com。
- Agent生態(tài)共建計(jì)劃:面向全球Agent框架團(tuán)隊(duì),提供限時(shí)免費(fèi)模型接入服務(wù)及Token限免支持。目前已與OpenCode、Hermes Agent、KiloCode等框架廠商展開深度合作,同時(shí)參與和贊助框架平臺(tái)的AI Hackathon等共創(chuàng)活動(dòng)。

結(jié)語(yǔ)
從2025年12月開源MiMo-V2-Flash,到2026年3月發(fā)布V2系列,再到4月V2.5-Pro登頂全球開源榜首,小米在大模型領(lǐng)域的迭代速度處于行業(yè)前列。此次MiMo-V2.5系列開源,不僅意味著小米成為首個(gè)登頂全球開源榜首的手機(jī)廠商,更通過(guò)Day 0級(jí)國(guó)產(chǎn)芯片全線適配,展現(xiàn)了開源模型從"參數(shù)競(jìng)賽"向"產(chǎn)業(yè)落地"的轉(zhuǎn)向。在OpenRouter平臺(tái),中國(guó)模型總調(diào)用量已連續(xù)五周超過(guò)美國(guó),占比達(dá)61%。隨著小米、DeepSeek等國(guó)產(chǎn)開源模型在Agent能力與推理效率上的持續(xù)突破,中國(guó)AI開源生態(tài)正從追趕階段進(jìn)入領(lǐng)跑階段。