DC娱乐网

向这位DeepSeek工程师致敬。向DeepSeek和月之暗面等中国AI前沿公司致敬。 DeepSeek R1登上《自然》封面那天,圈子里直接炸了锅。29.4万美元,折合人民币两百来万,训练出了跟OpenAI掰手腕的推理模型。你没看错,就是两百来万。OpenAI烧掉的钱够买好几栋楼了,DeepSe

向这位DeepSeek工程师致敬。向DeepSeek和月之暗面等中国AI前沿公司致敬。

DeepSeek R1登上《自然》封面那天,圈子里直接炸了锅。29.4万美元,折合人民币两百来万,训练出了跟OpenAI掰手腕的推理模型。你没看错,就是两百来万。OpenAI烧掉的钱够买好几栋楼了,DeepSeek这点预算连人家零头都不到,效果却硬生生打出来了。

月之暗面那边也没闲着。Kimi K3一口气干到2.8万亿参数,100万Token上下文窗口,直接登顶Code Arena榜单第一。马斯克都憋不住了,留言说“令人印象深刻”。这哥们平时嘴多硬啊,能让他开口夸一句,含金量不用我多说。

梁文锋,广东湛江出来的80后,浙大毕业,搞量化交易起家,2023年才创立DeepSeek。他说过一句话我印象特别深:中国AI不能永远做跟随者,差距不在于时间,在于创新和模仿之间。这话说得够狠,也够清醒。

杨植麟,92年生的汕头小伙,清华学霸,卡内基梅隆博士。公司名字取自平克·弗洛伊德的经典专辑,骨子里就透着股不走寻常路的劲儿。他带队搞出的K3,底层架构全是原创,没用蒸馏那套捷径。

这两家公司的共同选择特别有意思——开源。DeepSeek的R1开放权重,Kimi K3也开放完整权重,谁都能下载、研究、改。美国那边硅谷大佬急了,黄仁勋、扎克伯格都跳出来喊话白宫“快开源”。攻守之势,真的在变。

数据不会骗人。截至2025年12月,DeepSeek月活1.35亿,在国内AI原生应用里排第二,断层式领跑。斯坦福的报告更直白:中美顶级大模型差距已“实质性消除”,前20的AI机构里中国占了11家,超过美国。

说句掏心窝子的话,这帮人干的事,不只是技术突破。他们用开源这把钥匙,把AI的门槛砸低了。全球排名前十的开源AI模型,几乎全是中国企业的。以前是我们追着别人的论文跑,现在是别人盯着我们的开源代码研究。

有人还在质疑中国AI是不是抄的。DeepSeek直接用83页补充材料、64页审稿回复把质疑拍回去了——所有训练数据都是网页抓取,没有故意加入OpenAI生成的内容。这是全球第一个经过同行评审的大语言模型,OpenAI和谷歌都没敢做的事,DeepSeek做了。

各位读者你们怎么看?欢迎在评论区讨论。