DeepSeek-R1

DeepSeek-R1

DeepSeek-R1,是幻方量化旗下AI公司深度求索(DeepSeek)研發的推理模型。該模型採用強化學習進行後訓練,旨在提升推理能力,尤其擅長數學、代碼和自然語言推理等複雜任務。

2024年11月20日,全新研發的推理模型DeepSeek-R1-Lite預覽版正式上線。2025年1月20日,幻方量化旗下AI公司深度求索(DeepSeek)正式發布DeepSeek-R1模型,並同步開源模型權重。1月27日,DeepSeek套用登頂蘋果中國地區和美國地區套用商店免費APP下載排行榜,在美區下載榜上超越了ChatGPT。

DeepSeek-R1擁有卓越的性能,在數學、代碼和推理任務上可與OpenAI o1媲美。其採用的大規模強化學習技術,僅需少量標註數據即可顯著提升模型性能,為大模型訓練提供了新思路。此外,DeepSeek-R1構建了智慧型訓練場,通過動態生成題目和實時驗證解題過程等方式,提升模型推理能力。該模型完全開源,採用MIT許可協定,並開源了多個小型模型,進一步降低了AI套用門檻,賦能開源社區發展。

截至2025年1月27日,在世界大模型排名Arena上,DeepSeek-R1基準測試升至全類別大模型第三。

基本介紹

  • 中文名:DeepSeek-R1
  • 發布公司DeepSeek 
  • 發布時間:2025年1月20日(正式版) 
發展歷史,模型功能,基本特點,性能卓越,完全開源,自主學習,賦能社區,大模型排名,社會爭議,

發展歷史

2024年11月20日,DeepSeek宣布,全新研發的推理模型DeepSeek-R1-Lite預覽版正式上線。該模型處於疊代開發階段,僅支持網頁使用,暫不支持API調用。
2025年1月20日,幻方量化旗下AI公司深度求索(DeepSeek)正式發布DeepSeek-R1模型,並同步開源模型權重。同年1月24日,DeepSeek-R1在聊天機器人競技場綜合榜單上排名第三,與頂尖推理模型o1並列。1月26日訊息,在短短一個月內,中國AI初創公司深度求索(DeepSeek)先後發布了DeepSeek-V3和DeepSeek-R1兩款大模型,成本價格低廉,性能與OpenAI相當,讓矽谷震驚,甚至引發了Meta內部的恐慌,工程師們開始連夜嘗試複製DeepSeek的成果。1月27日,DeepSeek套用登頂蘋果中國地區和美國地區套用商店免費APP下載排行榜,在美區下載榜上超越了ChatGPT。 1月31日訊息,英偉達宣布,DeepSeek-R1 模型現已作為 NVIDIA NIM 微服務預覽版提供。DeepSeek-R1 NIM 微服務可以在單個 NVIDIA HGX H200 系統上每秒提供多達 3,872 tokens。

模型功能

DeepSeek-R1-Lite預覽版模型在美國數學競賽(AMC)中難度等級最高的AIME以及全球頂級編程競賽(codeforces)等評測中,超越了GPT-4o等模型。
DeepSeek-R1在後訓練階段大規模使用了強化學習技術,在僅有極少標註數據的情況下,極大提升了模型推理能力。在數學、代碼、自然語言推理等任務上,性能比肩OpenAI o1正式版。
DeepSeek-R1的一大技術亮點在於其採用了大規模強化學習(RL)進行後訓練。這項技術僅需少量標註數據,即可顯著提升模型的性能,為大型語言模型的訓練提供了新的思路。

基本特點

性能卓越

DeepSeek-R1可媲美OpenAI-o1。在各種任務上都展現出了驚人的實力,尤其是在數學、代碼和推理任務方面,其表現完全可以與OpenAI-o1比肩。

完全開源

DeepSeek-R1採用MIT許可協定,任何人都可以自由地使用、修改、分發和商業化該模型,包括模型權重和輸出。

自主學習

DeepSeek-R1於構建了一個智慧型訓練場,這一系統由三個技術組件構成:動態題目生成系統、過程驗證體系和協同工作機制。用一個比喻來說,每解完一題,系統自動生成更難的變體題,並實時驗證解題過程邏輯是否自洽。它迫使AI像數學家般提煉方法論,甚至能將幾何證明中的反證法遷移到代碼檢測中。

賦能社區

除了DeepSeek-R1本身,研發團隊還開源了6個從DeepSeek-R1蒸餾而來的小型模型。其中,32B和70B模型的性能同樣可以與OpenAI-o1-mini相媲美。這些小型模型的開源,進一步降低了AI套用的門檻,讓更多開發者可以參與到AI創新中來,極大地賦能了整個開源社區。

大模型排名

截至2025年1月27日,在世界大模型排名Arena上,DeepSeek-R1基準測試升至全類別大模型第三,其中,在風格控制類模型(StyleCtrl)分類中與OpenAI o1並列第一。其競技場得分達到1357分,略超OpenAI o1的1352分。

社會爭議

2025年1月22日,美國媒體Business Insider報導稱,DeepSeek-R1模型秉承開放精神,完全開源,為美國AI玩家帶來了麻煩。
2025年1月24日,名投資公司A16z的創始人馬克·安德森發文稱,Deepseek-R1是他見過的最令人驚嘆、最令人印象深刻的突破之一,而且還是開源的,它是給世界的一份禮物。
A16z合伙人、Mistral AI董事會成員Anjney Midha表示:“從斯坦福到麻省理工,DeepSeek-R1幾乎一夜之間成為美國頂尖大學研究人員的首選模型。”
2025年1月27日,英國《金融時報》發表評論文章,文章指出,DeepSeek-R1模型的性能幾乎可以媲美薩姆·奧爾特曼創立的OpenAI開發的模型,而成本僅為後者的零頭。DeepSeek的突破挑戰了人工智慧發展的核心信念,即認為更強大的硬體才是推動人工智慧發展的關鍵。1月27日晚,美國開放人工智慧研究中心(OpenAI)執行長薩姆·奧爾特曼在社交媒體平台X上發文,對DeepSeek-R1模型首次亮相表示歡迎。
2025年1月30日訊息,微軟CEO納德拉在電話會上強調,DeepSeek R1模型目前已可通過微軟的AI平台Azure AI Foundry和GitHub獲取,並且很快就能在Copilot+電腦上運行。納德拉稱DeepSeek“有一些真的創新”,AI成本下降是趨勢:“縮放定律(Scaling Law)在預訓練和推理時間計算中不斷積累。多年來,我們已經看到了AI訓練和推理方面的效率顯著提高。在推理方面,我們通常看到每一代硬體的性價比提高2倍以上,每一代模型的性價比提高10倍以上。”

相關詞條

熱門詞條

聯絡我們