技術規格與性能
模型參數規格
Mistral3系列包含3B、8B、14B三個小型密集模型及Mistral Large3,其中採用混合專家架構的版本支持256K上下文視窗。該系列覆蓋從邊緣設備到企業級推理的全場景需求,批量場景下吞吐量提升42%。
小型密集模型(3B/8B/14B)針對邊緣設備最佳化,混合專家架構版本擁有410億個活躍參數及6750億個總參數,二者形成參數規模與場景覆蓋的梯度組合。
性能基準
在
MMLU、HumanEval、MT-Bench等基準測試中,Mistral3與同規格Llama3.1模型表現持平或小幅領先。
技術架構
採用混合專家(MoE)架構,該架構僅激活與當前任務相關的子模型,具備410億活躍參數和6750億總參數,針對英偉達GB200 NVL72系統硬體最佳化。較此前版本可支持256K上下文視窗並提升推理效率。結合英偉達超級計算平台最佳化,該設計支持企業擴展部署多語言多模態模型。
開源協定
遵循Apache2.0協定開源,權重已同步上傳至Hugging Face與GitHub,允許免費商業使用。
簡介
Mistral 3是2025年12月2日法國人工智慧初創公司
Mistral AI發布的模型,包含3個小型密集模型(14B、8B和3B)以及
Mistral Large 3,通過架構最佳化提升了處理長上下文的能力。全系列保持Apache2.0開源協定,允許商業免費使用。
發展歷史
2025年12月2日,法國人工智慧初創公司
Mistral AI正式發布Mistral 3系列模型,包括3B、8B、14B三個小型密集模型及Mistral Large3,覆蓋從邊緣設備到企業級推理的全場景需求。新模型沿用Apache2.0開源協定,權重同步上傳至
Hugging Face與GitHub,允許商業免費使用。通過"滑動視窗注意力+分組查詢注意力"混合設計,14B版本在單張A100即可完成128K全上下文推理,批量場景下吞吐量提升42%。
Mistral Large3已在公司官方平台Le Platforme上線API,定價為每百萬token輸入0.8美元、輸出2.4美元,約為
GPT-4o的一半,並支持微調與私有部署。
商業套用與市場影響
Mistral Large3的
API定價為每百萬token輸入0.8美元、輸出2.4美元,約為
GPT-4o同期價格的一半,並支持微調與私有部署。該系列模型通過滑動視窗注意力與分組查詢注意力混合設計,實現單張A100 GPU即可運行128K上下文推理,使企業級部署成本顯著降低。
因符合歐洲
GDPR數據隱私標準,結合開放權重策略,Mistral3被認為將加速滲透中小企業及公共部門市場。行業觀察指出,Mistral3通過高性價比開源方案打破了閉源模型主導地位,可能推動AI基礎設施向多極化競爭格局演變。