LLM

小米 MiMo-V2 登場:兆級參數、百萬上下文與 87 億美元豪賭

小米 3 月 18 日發表 MiMo-V2-Pro(總參數逾 1 兆、啟動 42B、100 萬 token 上下文)、全模態 MiMo-V2-Omni 與 TTS 模型,隔日雷軍宣布三年至少投入 87 億美元。模型曾以 Hunter Alpha 匿名稱霸 OpenRouter。本文解析規格、開源策略與對開發者的影響。

小米 MiMo-V2 登場:兆級參數、百萬上下文與 87 億美元豪賭 — 文章封面
本頁內容6 個段落
  1. 一場發表會與一筆 87 億美元
  2. Hunter Alpha 之謎
  3. 兆級參數、42B 啟動
  4. 開源還是閉源?
  5. 對開發者的三個實際影響
  6. 參考來源

2026 年 3 月 18 日,小米在北京發表會上一次推出三個自研模型:旗艦 MiMo-V2-Pro、全模態的 MiMo-V2-Omni,以及文字轉語音的 MiMo-V2-TTS。隔天,CEO 雷軍宣布未來三年至少投入 87 億美元發展 AI。一家以手機與家電聞名的公司,正式跨進兆級參數模型的競賽。

這場發表會值得注意的不只是銀彈。MiMo-V2-Pro 總參數超過 1 兆、啟動參數 42B、上下文視窗 100 萬 token——這組規格已與前沿實驗室的旗艦模型同一量級。更戲劇性的是它的登場方式:發表前,這個模型曾以「Hunter Alpha」的化名匿名上架 OpenRouter,連續數天高居每日用量榜首,累計處理超過 1 兆 token,社群一度猜測是 DeepSeek 的新系統,小米隨後證實那是 MiMo-V2-Pro 的早期內部測試版。

一場發表會與一筆 87 億美元

Reuters 報導,雷軍在 3 月 19 日承諾三年至少 87 億美元的 AI 投資。對照小米既有的一年約 300 億人民幣研發預算,這代表資源重心的實質轉向:模型、算力與應用同時鋪開。模型團隊由 2025 年底加入的前 DeepSeek 研究員羅福莉主導——從 DeepSeek 挖角領軍人物、再砸錢建基礎設施,小米走的是一條已被驗證有效的路線。

Hunter Alpha 之謎

化名測試正在變成新模型的標準劇本:先匿名上架接收真實流量,避開品牌光環與輿論壓力,等數據漂亮了再揭曉身份。MiMo-V2-Omni 也用同樣手法,化名「Healer Alpha」。對開發者而言,這給了一個實際啟示:OpenRouter 榜單上那些來歷不明卻戰力強悍的模型,值得認真對待——它們可能是任何一家的下一代旗艦。

兆級參數、42B 啟動

MiMo-V2-Pro 採 MoE 架構:總參數超過 1 兆,每次推理只啟動 42B,上下文 100 萬 token。這樣的配比瞄準的是 agent 工作負載——長文件、多工具呼叫、跨對話任務——官方定位直接寫著「AI agent 的大腦」。獨立評測機構 Artificial Analysis 已把它排進智慧指數的前段;免費試用則因需求過大,透過 OpenClaw 等合作夥伴延長到 4 月 2 日。

開源還是閉源?

與 DeepSeek、Qwen 的開放權重路線不同,MiMo-V2 先走閉源 API:MiMo-V2-Pro 與 Omni 目前都是專屬 API 產品,羅福莉僅表示之後會開源某個變體,沒有給出時間表。這個選擇呼應了 2026 年開年就浮現的產業分歧(見〈2026 開年觀察〉):模型加速的同時,開源與閉源的路線正在拉開。對依賴開源權重的開發者來說,小米此刻是「可呼叫、不可下載」的選項。

對開發者的三個實際影響

第一,API 價格戰再添一名重量級玩家:Artificial Analysis 顯示其輸入單價趨近於零,便宜的兆級模型對 RAG 與 agent 的成本結構是實質利多。第二,OpenRouter 的匿名榜單成為新模型的驗證場,把它列入觀測可以比媒體報導更早嗅到趨勢。第三,閉源先行、開源在後一旦成為常態,開源社群拿到權重的時間會持續延後,技術選型時要把這個時差風險算進架構。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵