兆參數規模與開放時間

Mistral在10月6日推出Mistral Large 4公開預覽版,這是該公司迄今規模最大的模型,採用細粒度混合專家架構,具備1.05兆個參數,每次推理啟用490億個參數。模型原生支援多模態,可處理文字與圖片,內容視窗達100萬個Token,並支援超過160種語言。預計10月底將釋出模型權重,讓開發者能自行部署與應用。

評測表現與成本分析

在第三方評測中,ML4在CyberGym-E2E-AA測試取得82%,為所有受測模型最高,資安能力躋身全球前五。程式開發方面,DeepSWE v1.1得分61.7%,高於DeepSeek V4 Pro 0813與Qwen 3.8 Max。然而,其API價格為每100萬輸入Token 1.36美元、輸出Token 4.18美元,平均每項Intelligence Index任務成本約1.13美元,約為GLM-5.3-Flash與DeepSeek V4.1 Flash的4倍。

歐洲算力與市場定位

Mistral於2023年成立,今年9月完成30億歐元D輪募資,投後估值超過210億歐元。ML4在自有歐洲資料中心,以3,800張Nvidia Grace Blackwell GPU訓練,強調可部署於私有雲或地端環境,並受歐洲法律管轄。Artificial Analysis指出,ML4是美國及中國之外整體表現最強的模型,也是歐洲開發的最佳開放權重模型。