DeepSeek V3

DeepSeek-V3為自研MoE模型,671B參數,激活37B,在14.8T token上進行了預訓練。

基本介紹

  • 外文名:DeepSeek V3
  • 類型:AI大模型,MoE模型
發展歷史,社會影響,

發展歷史

DeepSeek-V3為自研MoE模型,671B參數,激活37B,在14.8T token上進行了預訓練。
2024年12月,DeepSeek-V3正式發版。

社會影響

DeepSeek新一代模型的發布意味著AI大模型的套用將逐步走向普惠,助力AI套用廣泛落地;同時訓練效率大幅提升,亦將助力推理算力需求高增。我們持續看好AI產業鏈的加速落地機遇,建議重點關注AI套用、AI Infra、AI算力三大主線。

相關詞條

熱門詞條

聯絡我們