人物經歷 早年經歷 1985年,梁文鋒出生於
廣東省 湛江市,在廣東湛江長大。梁文鋒國小就讀於吳川市梅菉國小(曾就讀於吳川市梅嶺國小的學前班),國小六年級時他通過考試被
吳川市第一中學 錄取,在吳川一中完成了國中、高中學業。
2002年,梁文鋒以吳川一中“高考狀元”的成績考入浙江大學
電子信息工程 專業,屬於電子工程系人工智慧方向。
2007年,考上浙江大學
信息與通信工程 專業研究生。2010年,獲得信息與通信工程碩士學位,畢業論文題目是《基於低成本PTZ攝像機的目標跟蹤算法研究》。
創業經歷 2008年起,梁文鋒開始帶領團隊使用機器學習等技術探索全自動量化交易。2013年,他與浙大同學徐進共同創立了
杭州雅克比投資管理有限公司 。
2015年,成立了
杭州幻方科技有限公司 ,致力於通過數學和人工智慧進行量化投資。當年的市場波動中,幻方依靠先進的高頻量化策略取得了很好的成績。
2016年是幻方的重要轉折點。10月21日,幻方量化推出第一個AI模型,實現了所有量化策略的AI化轉型。到2017年底,幾乎所有的量化策略都採用AI模型計算。
2018年,幻方正式確立了以AI為核心的發展戰略。隨著業務的快速擴展,算力瓶頸逐漸顯現。2019年,梁文鋒帶領團隊自主研發了“螢火一號”訓練平台,總投資近2億元,搭載了1100塊GPU;同年,梁文鋒在當年的金牛獎頒獎儀式上發表主題演講《一名程式設計師眼裡中國量化投資的未來》。2020年開始,幻方累計投資超億元、占地面積相當於一個籃球場的AI超級計算機“螢火一號”正式投入運作,號稱可以匹敵4萬台個人電腦的超級算力。
2021年,“螢火二號”的投入增加到10億元,搭載了約1萬張英偉達A100顯示卡;幻方的資產管理規模突破千億大關,躋身國內量化私募領域的“四大天王”之列。
2023年5月,梁文鋒宣布做通用人工智慧(
AGI )。7月,幻方量化宣布成立大模型公司DeepSeek,即杭州深度求索人工智慧基礎技術研究有限公司,正式進軍通用人工智慧領域。
2024年5月,DeepSeek發布了DeepSeekV2。DeepSeek-V2的API定價為每百萬tokens輸入1元、輸出2元,價格僅為GPT-4 Turbo的百分之一。同年12月27日,DeepSeek-V3面世,並公布了長達53頁的訓練和技術細節。
2025年1月20日,DeepSeek正式發布DeepSeek-R1模型。
2025年1月,DeepSeek爆火震動美國科技界,85後創始人梁文鋒回應:中國AI不可能永遠跟隨。網友:中國年輕人無限可能。2月18日,梁文鋒親自上陣提交的論文《Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention》發表。4月17日,據英國
《金融時報》 報導,英偉達CEO黃仁勛訪問北京並會見了生成式人工智慧初創公司DeepSeek的創始人梁文鋒,討論如何為中國設計下一代晶片,以滿足客戶需求以及中美雙方的監管要求。5月,梁文鋒等人發表了一篇名為《Insights into DeepSeek-V3: Scaling Challenges and Reflections on Hardware for Al Architectures(深入了解DeepSeek-V3:人工智慧架構硬體的擴展挑戰與思考)》的回顧性論文,深入分析了DeepSeek-V3/R1模型架構及其人工智慧基礎架構。
2025年9月,梁文鋒在人工智慧領域相關研究中取得重要成果,其作為通訊作者,與DeepSeek團隊共同完成的關於DeepSeek-R1推理模型的研究論文,成功登上國際權威期刊《
自然 (Nature)》封面。
2026年1月12日晚間,DeepSeek發布了一篇新論文,主題為《Conditional Memory via Scalable Lookup:A New Axis of Sparsity for Large Language Models》(直譯為基於可擴展查找的條件記憶:大語言模型稀疏性的新維度),梁文鋒再度出現在了作者名單最後。這篇論文為北京大學和DeepSeek共同完成。
家庭關係 父母為人淳樸,都是國小老師。
主要貢獻 2019年,梁文鋒帶領團隊自主研發了“螢火一號”訓練平台,總投資近2億元,搭載了1100塊
GPU 。兩年後,“螢火二號”的投入增加到10億元,搭載了約1萬張英偉達A100顯示卡。
2021年,在梁文鋒參與的論文中提到,他們正在部署的螢火二號系統,“配備了1萬張A100GPU晶片”,在性能上接近DGX-A100(
英偉達 推出的人工智慧專用超級計算機),但成本降低了一半,同時能耗減少了40%。
2021年,幻方的資產管理規模突破千億大關,躋身國內量化私募領域的“四大天王”之列。
2023年,梁文鋒宣布將正式進軍通用人工智慧領域,並創辦了深度求索DeepSeek,專注於做真正人類級別的人工智慧。
2023年7月,幻方量化宣布成立
大模型 公司DeepSeek,正式進軍通用人工智慧領域。梁文鋒為創始人。
2024年5月,DeepSeek發布混合專家語言模型DeepSeek-V2。同年12月,DeepSeek-V3問世,這款性能優越且性價比極高的大語言模型,被矽谷同行譽為“來自東方的神秘力量”。
2025年1月20日, DeepSeek正式發布DeepSeek-R1模型。該模型在數學、代碼、自然語言推理等任務上,性能比肩OpenAI o1正式版。
主要作品 由DeepSeek團隊共同完成、梁文鋒擔任通訊作者
Insights into DeepSeek-V3: Scaling Challenges and Reflections on Hardware for Al Architectures
Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention
社會活動 2025年1月20日,梁文鋒參加了中共中央政治局常委、國務院總理
李強 主持召開的專家、企業家和教科文衛體等領域代表座談會,並在會上發言。
梁文鋒在中共中央政治局常委、國務院總理李強主持召開的專家、企 2025年2月10日至11日,法國
巴黎 迎來國際人工智慧行動峰會。有訊息稱DeepSeek公司創始人梁文鋒已赴巴黎參加人工智慧峰會。知情人士回應稱:假的,梁文鋒在國內。
2025年4月17日,英偉達CEO黃仁勛訪問北京並會見了生成式人工智慧初創公司DeepSeek的創始人梁文鋒,討論如何為中國設計下一代晶片,以滿足客戶需求以及中美雙方的監管要求。
2025年8月,入選2025年全球100位最具影響力AI人物名單。
財富排名 獲獎記錄 其他 位列《
王宏偉 2025中國AI人工智慧+人物100強》第2名
獲獎
TopBrand 2025中國品牌青年500強第八名
獲獎