小米 MiMo-V2.5 系列開源:相較 GPT-5.4 的 1T 參數,具有更優的 token 效率

Gate 新聞訊息,4月27日——小米的 MiMo 團隊已在 MIT 授權下開源 MiMo-V2.5 系列大型語言模型,支援商業部署、持續訓練與微調。兩個模型都具備 100 萬 token 的上下文視窗。MiMo-V2.5-Pro 是一種純文字的專家混合 (MoE) 模型,總參數為 1.02 兆(trillion),啟用參數為 420 億;而 MiMo-V2.5 是原生多模態模型,總參數為 3100 億,啟用參數為 150 億,支援文字、圖像、影片與音訊理解。

MiMo-V2.5-Pro 目標鎖定複雜的代理(agent)與程式設計任務。在 ClawEval 基準測試中,它在每個任務軌跡約消耗 70,000 個 token 的情況下達成 64% 的 Pass@3——相較 Claude Opus、Gemini 3.1 Pro 與 GPT-5.4,token 減少 40% 到 60%。該模型在 SWE-bench Verified 上得分 78.9。在一項展示中,V2.5-Pro 能在 4.3 小時內、透過 672 次工具呼叫,獨立完成為北京大學編譯器課程專案開發的完整 SysY-to-RISC-V 編譯器,並在隱藏測試集上取得 233/233 的滿分。

MiMo-V2.5 專為多模態代理情境而設計,配備專用的視覺編碼器 (729 million parameters) 與音訊編碼器 (261 million parameters),在 Claw-Eval 的一般子集上得分 62.3。兩個模型採用結合滑動視窗注意力 (SWA) 與全域注意力 (GA) 的混合架構,並搭配 3 層的多 token 預測 (MTP) 模組以加速推論。模型權重可在 Hugging Face 取得。

在開源發布的同時,MiMo 團隊推出了「Orbit Quadrillion Token Creator Incentive Program(Orbit Quadrillion Token Creator 獎勵計畫)」,向全球使用者在 30 天內免費提供 100 兆 token。個別開發者、團隊與企業可透過計畫頁面申請,評估週期約為 3 個工作日;核准後的權益將以 Token Plans 或直接抵扣的形式分發,並與像 Claude Code、Cursor 等工具相容。

免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見聲明

相關文章

Claw Intelligence 與 Block Sec Arena 合作以強化 BNB Chain 安全性

根據 Block Sec Arena 在 4 月 30 日的官方公告,Claw Intelligence(一個由 AI 驅動、建立在 BNB Chain 上的 Web3 平台)宣布與 Block Sec Arena 建立策略夥伴關係,以將先進的資安基礎設施整合進其生態系統。此次合作旨在強化 p

GateNews6小時前

NTT 宣布 AI x OWN 事業計畫,規劃於 2033 年前將日本發電能力提升至 1 GW 的三倍

4 月 27 日,NTT 總裁 篠田 昭太 宣布「AI x OWN」計畫,該公司努力重新設計網際網路基礎設施以支援即時 AI 使用。NTT 計畫將其國內發電能力從目前約 300 MW 提升至 2033 財政年度前後約 1 GW,作為這家電信巨頭

GateNews7小時前

AI 平台 Certifyde 於 5 月 1 日完成 200 萬美元種子輪融資,由 Ripple 執行長 Brad Garlinghouse 背書

根據 TechfundingNews,AI 應用平台 Certifyde 於 5 月 1 日完成一輪 200 萬美元的種子輪融資。投資方包括 K5 Global、Flamingo Capital,以及天使投資人,包括 Honey 的聯合創辦人 George Ruan、Ripple 執行長 Brad Garlinghouse,以及 Nutra 的聯合創辦人 Roland

GateNews8小時前

Pentagon 科技長:Anthropic 仍黑名單、Mythos 例外處理

美國國防部科技長(Pentagon technology chief)5 月 1 日對國會表示,「Anthropic 仍在黑名單上,但 Mythos Preview 是另一個議題」,正式承認國防部對 Anthropic 主品牌與其新模型 Mythos 採取區別對待。此一表態與 4 月 19 日 Axios 揭露 NSA(國家安全局)已實際使用 Mythos 形成呼應,並正式確立「Mythos 例外管道」的政策走向—同時也意味國防部曾在法庭上主張使用 Anthropic 工具會威脅國安,與當前實質做法形成法律論述上的內部矛盾。 Anthropic vs Pentagon

鏈新聞abmedia9小時前

137 Ventures 在新資金中完成 $700M ,管理資產(AUM)達到 150 億美元

根據 ChainCatcher,早期投資 SpaceX 的 137 Ventures 近期完成了兩檔新基金的募資,總額超過 7 億美元,將其管理資產提高至超過 150 億美元。這筆新資本將用於投資 AI 代理、機器人以及太空推進

GateNews9小時前

Reddit 第 16% 飆升,因 Q2 展望強勁;蘋果面臨 Mac 缺貨,因 AI 需求超過供應

Reddit 的股價在週五美股開盤前上漲 16%,原因是該公司發布了高於預期的未來一季營收展望。日活躍訪客成長 17% 至 1.268 億,且全球每位用戶平均營收跳升 44%,由 AI 驅動

GateNews9小時前
留言
0/400
暫無留言