当前位置:首页 > 全国干部教育培训网 > 新闻动态

浙大校友梁文锋,2025《自然》十大人物!

2026-09-03

03

2026-09
2026

25

46

分享

来源:校友风采

     2023年,梁文锋创立了人工智能公司DeepSeek,并于2025年1月发布了具有里程碑意义的AI推理模型R1。该模型以卓越的性能与显著的低成本优势,迅速在国际人工智能界引发震动,重塑了外界对技术门槛的认知。

       梁文锋生于广东,求学于浙江大学。2007年本科毕业于电子信息工程专业、2010年硕士毕业于信息与通信工程专业,在浙江大学信息与电子工程学院的学习,为他奠定了扎实的算法与计算机视觉基础。他的毕业论文聚焦于视频目标跟踪算法的设计,早在学生时期,就已展现出对长期主义的笃信与高效的行动力。

      多年前,一次源于纯粹好奇的举动,悄然埋下了未来的种子:他购入了上万张英伟达GPU显卡,只为探索这些芯片在前沿研究中的可能性。后来他在采访中这样比喻:“就像家里买钢琴,一是买得起,二是有一群迫不及待想弹奏的人。”这份看似随性的“尝试”,却意外成为破解中国大语言模型发展瓶颈的关键钥匙。

       对技术透明度的坚持,是DeepSeek的另一重底色。2025年9月,团队在《自然》期刊上发表了题为《DeepSeek-R1通过强化学习激励大语言模型推理》的封面论文,首次完整公开了R1模型的构建、训练全过程与惊人成本——训练R1仅花费29.4万美元,即便加上基础模型的600万美元投入,总成本也远低于同类模型动辄数千万美元的常态。该研究成为首个经受同行评审的大型语言模型工作(D. Guo et al. Nature 645, 633–638; 2025)。通过分享这份完整的“配方”,DeepSeek为全球AI研究者提供了可复现、可借鉴的推理模型训练范本。

       正如梁文锋始终着眼于长远、善于挖掘人才潜力,DeepSeek在人才选拔上也更重潜能而非资历。公司内部淡化层级,鼓励自主探索。在梁文锋与众多中国科技人眼中,DeepSeek并非终点,而是一个关键的路标:它正推动人工智能走向更“深”的探索,追寻从“跟随”到“原创”的真正突破。