DeepSeek-V3.2

DeepSeek-V3.2

DeepSeek-V3.2是深度求索(DeepSeek)公司於2025年9月發布的大模型,包含日常場景推理版本DeepSeek-V3.2和長思考增強版本DeepSeek-V3.2-Speciale。

該模型獲得十五五政策重點支持,通過國家算力網際網路實現算力互聯互通,並參與數據要素開發利用政策試點。其採用CUDA/TileLang雙版本GPU運算元架構,支持160K超長上下文處理能力,寒武紀、昇騰、海光等國產晶片廠商實現Day 0適配,通過華為雲、魔搭等平台完成適配。模型引入TileLang程式語言構建硬體調度層,並採用自研UE8M0 FP8新型數據格式。2025年9月29日發布的實驗版本DeepSeek-V3.2-Exp將API服務價格下調超50%,輸入(快取命中/未命中)價格分別降至0.2元/百萬tokens和2元/百萬tokens,輸出價格降至3元/百萬tokens。

同年12月1日,正式版DeepSeek-V3.2和臨時API開放的Speciale版本完成全平台更新,技術報告顯示V3.2-Speciale版本在評測中超越GPT-5和谷歌Gemini 3 Pro。基於該架構開發的開源數學專用模型DeepSeekMath-V2於11月27日發布,在國際數學奧林匹克競賽評測中取得金牌成績。同年12月,該模型逐步接入騰訊生態,與騰訊混元2.0共同套用於元寶、ima等AI套用。2025年12月15日,天翼雲息壤接入DeepSeek-V3.2。

基本介紹

  • 外文名:DeepSeek-V3.2
  • 上線時間:2025年9月29日   
  • 所屬品牌:DeepSeek
  • 最新版本:DeepSeek-V3.2、DeepSeek-V3.2-Speciale 
市場競爭動態,發展歷程,技術突破與生態協同,存儲最佳化,編程框架,政策支持,生態影響,產品定價,

市場競爭動態

2025年12月10日,Mistral AI發布開原始碼模型Devstral 2系列,其123B參數模型在SWE-bench Verified評測中以72.2%得分顯著超越DeepSeek-V3.2的基準表現(勝率42.8%,敗率28.6%)。該模型通過改進架構實現了接近閉源模型Claude Sonnet 4.5的性能水平,並展現出7倍的成本效率優勢。
Mistral採用的修改版MIT許可證包含2000萬美元月收入限制條款,通過與NVIDIA build平台的技術整合形成差異化部署路徑。Mistral Vibe CLI與Zed IDE深度集成的開發工具鏈在終端環境多檔案協同開發場景中形成PR周期效率對標。
2025年12月17日,小米發布MiMo-V2-Flash大模型,在多數評測中性能超過DeepSeek V3.2。
該模型總參數為309B,激活參數僅15B,在全球開源模型的代碼和Agent評測基準中已躋身Top2行列。模型採用對開發者友好的MIT開源協定,基礎著作權重已經在Hugging Face上發布。

發展歷程

2025年9月訊息,DeepSeek-V3.2將發布,v3.2-base已上傳至DeepSeek的HuggingFace官方頁面。
2025年9月29日,DeepSeek-V3.2-Exp模型正式發布,並已在Huggingface與魔搭開源,同步發布技術報告及CUDA/TileLang雙版本GPU運算元,華為雲、魔搭等平台完成適配並支持160K長度上下文。同日,官方App、網頁端、小程式均已同步更新為DeepSeek-V3.2-Exp。
截至9月30日上午6點,華為雲、PPIO派歐雲、優刻得等雲平台已宣布上線DeepSeek-V3.2-Exp,寒武紀、昇騰、海光信息等AI晶片廠商已經宣布適配。
2025年11月27日,基於DeepSeek-V3.2-Exp架構開發的開源數學專用模型DeepSeekMath-V2發布,在多項國際數學競賽評測中達到人類頂級水平。
2025年12月1日,DeepSeek發布正式版模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale,官方網頁端、App和API均已更新為正式版,Speciale版本目前僅以臨時API服務形式開放供社區評測與研究。DeepSeek-V3.2的目標是平衡推理能力與輸出長度,適合日常使用場景如問答和通用Agent任務;DeepSeek-V3.2-Speciale則旨在將開源模型的推理能力推向極致,探索模型能力邊界。DeepSeek兩款新模型均達到世界級推理性能 :V3.2推理能力與文本長度兼顧,擁有GPT-5級別性能,適合日常驅動;V3.2-Speciale極致推理能力,取得了4項金牌級成績。機構指出,DeepSeek推動中國算力生態協同創新與演進,進一步將模型與算法層面的創新,與中間層的編譯語言與更底層的計算晶片協同起來,推動中國算力生態的成長。

技術突破與生態協同

存儲最佳化

DeepSeek-V3.2採用自研UE8M0 FP8新型數據格式,通過8位全指數位分配機制實現存儲效率提升。該格式通過分塊縮放保持FP8表示範圍,成為首個將FP8混合精度訓練套用於開源超大規模模型的技術方案。

編程框架

引入TileLang程式語言構建硬體調度層,採用類Python語法實現算法邏輯與硬體解耦。通過分層設計支持國產晶片開發者的多級最佳化,降低傳統CUDA生態的遷移門檻,該方案已套用於V3.2版本的運算元開源實現。

政策支持

獲得十五五政策重點支持,通過國家算力網際網路建設實現算力互聯互通,深度參與數據要素開發利用政策試點。2025年9月與華為昇騰、寒武紀及海光完成V3.2模型零日適配,建立系統協同最佳化機制。

生態影響

被權威機構評價為算力生態關鍵推動者,通過FP8格式標準革新和TileLang編程框架及預置SGLang、vLLM等推理框架核心,帶動國產晶片設計最佳化。2025年12月1日,DeepSeek發布DeepSeek-V3.2和DeepSeek-V3.2-Speciale正式版,技術報告顯示V3.2-Speciale版本在評測中全方位超越GPT-5並在多項推理基準測試中超過谷歌Gemini 3 Pro。摩根大通2025年12月研究報告指出,該版本通過預置SGLang、vLLM等推理框架核心並明確轉向國產硬體自主,使得阿里巴巴、騰訊、百度、中微公司、北方華創、華勤技術、浪潮信息等企業成為主要受益者。2025年12月,DeepSeek V3.2逐步接入騰訊生態,與騰訊自研大模型混元2.0共同在元寶、ima等騰訊AI原生套用中上線,同時騰訊雲開放了相關模型的API及平台服務。2025年12月15日,天翼雲息壤作為中國電信天翼雲的一體化智算服務平台,正式接入DeepSeek-V3.2。官方測試顯示,該模型在多項性能基準中與行業主流模型相當,推理成本僅為行業主流模型的1/3。

產品定價

DeepSeek-V3.2-Exp發布後,DeepSeek官方API價格進行了下調。輸入(快取命中)價格由0.5元/百萬tokens下調為0.2元/百萬tokens;輸入(快取未命中)價格由4元/百萬tokens下調為2元/百萬tokens;輸出價格由12元/百萬tokens下調為3元/百萬tokens。在新的價格政策下,開發者調用DeepSeek API的成本將降低50%以上。
DeepSeek-V3.2
DeepSeek-V3.2-Exp API價格

相關詞條

熱門詞條

聯絡我們