程式忍者PGNinja

Hacker News

Mistral 推出旗艦模型 Large 4,程式碼與資安能力提升

· Mistral AI 發布旗艦模型 Large 4,採用混合專家架構,程式碼與資安評測成績亮眼,權重月底公開下載。

Mistral AI 是法國的 AI 公司,2026 年 10 月 6 日發布新旗艦模型 Large 4,先以公開預覽上線,權重預計月底開放下載。這款模型主打企業與開發者在程式碼撰寫、資安防護與多語言任務上的實際需求,並強調原生支援圖像理解等多模態輸入。

Large 4 採用混合專家(MoE)架構,總參數達 1 兆,但每次推論只啟用 49 億參數。模型訓練於 Mistral 位於歐洲自建資料中心內的 3800 張 NVIDIA Grace Blackwell GPU,訓練資料涵蓋超過 160 種語言,並透過強化學習進行後訓練,每天產生約 330 億個 token。

官方評測顯示,Large 4 在資安相關任務表現突出,漏洞複現與修補成績達 82%,官方稱為所有模型中最高,網路安全防護指數排名全球前五;程式碼能力評測 DeepSWE v1.1 達到 61.7%,人工評分僅次於 Claude Opus 5,社群也熱烈討論它與其他旗艦模型在智能體任務上的競爭。

對正在學程式的孩子來說,這則新聞比較偏產業面:一般學習階段不會直接用到 1 兆參數的旗艦模型,但可以藉此了解業界如何用「混合專家架構」只啟用一小部分參數來省成本,這和寫程式時思考效能與資源分配的邏輯是相通的。

AI大型語言模型資安開發工具

其他新聞