DC娱乐网

读完这篇关于 DeepSeek 的文章,简单整理一份笔记存档。 很多人以为 DeepSeek 是靠着 R1 突然爆红,仔细梳理才发现并不是。 早在公司成立之前,一批研究者就已经在各大高校、实验室互相合作。北大、清华、北航、微软亚洲研究院的不少年轻人,很早就在一起做论文,分别研究 NLP、数学推理、代码、视觉、 ​

读完这篇关于 DeepSeek 的文章,简单整理一份笔记存档。很多人以为 DeepSeek 是靠着 R1 突然爆红,仔细梳理才发现并不是。早在公司成立之前,一批研究者就已经在各大高校、实验室互相合作。北大、清华、北航、微软亚洲研究院的不少年轻人,很早就在一起做论文,分别研究 NLP、数学推理、代码、视觉、高性能计算。2023 年,这批人陆续加入 DeepSeek。2024 年 DeepSeekMath 发布,提出了 GRPO 算法,打下推理能力的基础。这篇论文一共 11 位作者,后来全部成为 R1 的核心人员。之后 DeepSeek‑Coder、MoE 模型陆续出来。2025 年 R1 出圈,多模态、软硬协同系统也完善起来。2026 年 V4‑Pro 发布,百万上下文,性能再次提升。几位关键人物简单记一下:王培懿、许润昕、代达劢,北大团队,几乎参与了早期所有重要模型;邵智宏、苟志斌主攻数学推理与工具调用,是 R1 推理能力的关键;郭达雅、朱启豪负责代码方向;陈小康带领多模态团队;赵成钢以及一批年轻学生,深耕底层系统、GPU 内核、分布式通信。DeepSeek 的组织方式也很有意思,没有死板的部门划分,人跟着问题走,项目一变,研究者就重新组合在一起。一件事给我的启发:很多一鸣惊人的成果,背后都是漫长的积累,各路条件慢慢汇合,才走到爆发的一刻。读书笔记声明:本文仅为个人学习复盘、线上存档笔记,无商业用途。内容整理参考原文:《深度|草蛇灰线,终成汇流,DeepSeek 技术谱系与那群提前出发的人》作者:ZFinance,发布于今日头条。原文版权归原作者所有。