台灣即時新聞 · 快速準確全面
快訊

Mistral推出兆參數大型模型ML4,10月底將釋出權重

Mistral推出兆參數大型模型ML4,10月底將釋出權重 cover

法國人工智慧公司Mistral在十月六日推出Mistral Large 4(簡稱ML4)的公開預覽版本。這是該公司成立以來規模最大、能力最強的一款模型,參數總量達到一兆零五百億個,採用細粒度混合專家架構,每次推理時實際啟用的參數約四百九十億個。

第三方評測機構Artificial Analysis在初步測試後指出,ML4是目前美國與中國之外、整體表現最強的模型。Mistral方面則表示,這也是目前由美國或歐洲開發團隊所推出的最佳開放權重模型。

在模型規格上,ML4原生支援多模態輸入,可以處理文字與圖片。它的視覺編碼器擁有十六億個參數,上下文視窗可達一百萬個Token,支援超過一百六十種語言。目前使用者已經可以透過Mistral Studio與官方API使用這款模型,模型權重預計在十月底正式釋出。

在資安能力測試方面,ML4的表現格外亮眼。在Artificial Analysis的Cyber Index評測中進入全球前五名,其中在要求模型重現並修補真實開源軟體漏洞的CyberGym-E2E-AA測試上拿下百分之八十二,是所有受測模型中最高的分數。Mistral另行公布的資安競賽基準Cybench中,ML4解出九成三的題目,在開放權重模型中名列前茅。

程式開發領域的評測同樣交出不錯的成績單。ML4在DeepSWE v1.1測試中取得百分之六十一點七,分數高於DeepSeek V4 Pro 0813與Qwen 3.8 Max等對手。在涵蓋六百五十七項企業工作流程的AutomationBench評測上,ML4取得百分之五十九點九,領先Kimi K3、MiMo-V2.6-Pro以及DeepSeek V4 Pro。

在視覺定位能力上,ML4於測試複雜影像中物件定位能力的Dense 200評測中取得百分之四十二,略高於GPT-6 Astra的百分之四十一。Artificial Analysis給予ML4的Intelligence Index總分為三十八分,與GPT-6 Luna(max)的三十八分持平,接近DeepSeek V4.1 Flash(max)的三十九分。

不過這款模型的成本並不便宜。標準API定價為每百萬個輸入Token一點三六美元、輸出Token四點一八美元。Artificial Analysis估算,平均每項Intelligence Index任務的成本約為一點一三美元,約為GLM-5.3-Flash與DeepSeek V4.1 Flash的四倍。

值得注意的是,各項評測所採用的比較模型並不完全相同,讀者在解讀分數時仍須留意對照基準的差異。

ML4的訓練地點也頗具話題性。它是在Mistral自有歐洲資料中心,以三千八百張Nvidia Grace Blackwell GPU從零開始訓練完成的。Mistral強調,未來ML4可以部署於私有雲或地端環境,也可由Mistral在歐洲自行營運,資料受歐洲法律管轄,這正呼應了該公司長期主張的歐洲AI主權路線。

Mistral成立於二〇二三年,由前Google DeepMind與Meta研究員共同創辦,主打開放權重模型。該公司今年九月完成D輪募資,金額高達三十億歐元,投後估值超過兩百一十億歐元,並持續擴充歐洲自有資料中心的算力。

從市場格局來看,ML4的登場象徵歐洲陣營在超大型模型賽道上正式擁有一兆參數等級的作品。隨著十月底權重釋出,全球開發者將能直接下載部署,實際應用效果如何,值得持續觀察。