原文標題:Introducing Mistral Large 4
Mistral 10 月 6 日推出 Mistral Large 4(ML4)public preview。官方資料顯示,ML4 是 1 兆參數的原生多模態模型,每次推論啟用 490 億參數,為 Mistral 目前規模最大、能力最完整的模型。Preview API 已可在 Mistral Studio 使用,模型權重預計在 10 月底前釋出。
ML4 從零開始使用 3,800 張 NVIDIA Grace Blackwell GPU,在 Mistral 位於歐洲的資料中心訓練;公開預覽也由同一套基礎設施提供。模型訓練資料涵蓋 160 多種語言,並把 coding、agentic workflows、multimodal understanding、金融、法律與資安工作列為主要能力。
在 Mistral 公布的測試中,ML4 於 DeepSWE v1.1 得分 61.7%、SWE-Atlas-QnA 59.4%、Terminal-Bench 4 為 28.3%;Cybench 40 項挑戰完成率為 93%。官方也特別強調資安能力,表示模型權重釋出前仍會與資安團隊、合作夥伴及政府單位進行 red-teaming。
Mistral 目前將 API 輸入價格列為每百萬 tokens 1.36 美元、輸出 4.18 美元。由於模型仍在 public preview,官方表示訓練與強化學習仍在持續,最終權重、完整架構細節與更多 benchmark 將在月底進一步公布。
發生了什麼事
Mistral 推出 ML4 public preview,採 1T 總參數、49B active parameters 的原生多模態 MoE 設計。
為什麼重要
這是歐洲 AI 業者在開放權重、主權部署與高階 coding/cyber 能力上的大型模型競爭新節點。
影響哪些人
AI 開發者、企業模型平台、需要私有部署的組織,以及 coding、資安與多模態應用團隊最直接受影響。
已確認與未確認
Preview API、參數規模、訓練 GPU 與目前價格已公布;模型權重仍未釋出,最終架構細節與正式版表現仍可能變動。