DeepSeek-V3為自研MoE模型,671B參數,激活37B,在14.8T token上進行了預訓練。
基本介紹
- 外文名:DeepSeek V3
- 類型:AI大模型,MoE模型
發展歷史,社會影響,
發展歷史
DeepSeek-V3為自研MoE模型,671B參數,激活37B,在14.8T token上進行了預訓練。
2024年12月,DeepSeek-V3正式發版。
社會影響
DeepSeek新一代模型的發布意味著AI大模型的套用將逐步走向普惠,助力AI套用廣泛落地;同時訓練效率大幅提升,亦將助力推理算力需求高增。我們持續看好AI產業鏈的加速落地機遇,建議重點關注AI套用、AI Infra、AI算力三大主線。
