DC娱乐网

我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSeek

我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSeek之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑“掉队”的90后。
科技圈有个老习惯,模型热度一降,讣告就先写好了。前脚还在夸某家公司前途无量,后脚便能郑重宣布它“退出牌桌”。
月之暗面就经历过这种冷暖。DeepSeek席卷全球之后,Kimi一度被质疑掉队。可到了7月,一款Kimi K3突然摆上桌面,硅谷的笑声很快变成了计算器按键声。
7月16日,杨植麟创办的月之暗面发布Kimi K3。这个模型拥有2.8万亿总参数,采用混合专家架构,支持原生多模态和100万词元上下文,重点面向长程编程、知识工作、复杂推理和智能体任务。
月之暗面同时宣布,计划在7月27日前公布完整模型权重。截至7月23日,这项开放工作仍在按照公布的时间表推进。
这里最值得注意的,不是“参数越大越神奇”这种简单口号。混合专家架构的门道,在于模型虽然体量巨大,处理每项任务时却只调动部分专家协同工作。
这有点像一支编制庞大的技术部队,真正执行任务时,按照需要派出专业分队。既要把能力做高,也要控制推理成本,这才是工程较量中的硬骨头。
K3上线后,前端编程表现进入国际公开测评的领先位置,海外开发者和企业用户迅速涌入。短短两天,需求便逼近现有算力集群的承受极限。
月之暗面随后暂停接收新的个人订阅,优先保障原有付费用户,并着手调整算力供应。发布会上的掌声可以提前安排,服务器被真实任务压满却很难彩排。
K3亮相后的首个美股交易日,道琼斯指数下跌0.77%,标准普尔500指数下跌1.01%,纳斯达克指数下跌1.40%,半导体板块继续承压。
不过,把整场下跌全部记在杨植麟账上,多少有点像篮球输了怪计分牌。中东局势、利率预期、芯片股估值和企业业绩,同样影响了当天行情。K3不是唯一原因,却确实加重了市场对人工智能投资回报的担忧。
华尔街真正紧张的,也不是一天跌了几个点,而是过去那套商业算盘可能需要重新按一遍。美国科技巨头习惯依靠封闭模型、昂贵算力和生态壁垒建立优势,而中国企业正在连续推出能力更强、价格更具竞争力的开放模型。
投资者自然会追问,闭源服务还能维持多高的溢价,巨额算力投入还能讲多久的故事。一次突破可以解释为偶然,接连出现多个有国际竞争力的中国模型,就不能继续假装没看见。
杨植麟也不是被风口临时吹起来的人物。他出生于1992年,本科毕业于清华大学,后来在卡内基梅隆大学取得博士学位。
读博期间,他参与提出Transformer-XL和XLNet,在自然语言处理领域早已留下技术足迹。2023年,他创办月之暗面,把研究成果从论文搬进创业公司的机房。
Kimi的发展并非一路敲锣打鼓。早期产品凭借长文本能力迅速走红,随后国内大厂加速投入,DeepSeek又以强劲表现吸引全球目光。
热度被分流后,外界很快给月之暗面贴上“掉队”标签。杨植麟团队没有把主要精力放在广告声量上,而是继续推进基座模型、长上下文、编程和智能体能力。
2025年7月,Kimi K2以开放权重方式推出,强化编程与智能体任务。2026年1月,Kimi K2.5加入原生多模态和智能体集群能力。
3月的中关村论坛上,杨植麟又提出,要通过开源和多智能体协作探索智能上限。K3的出现,是这条技术路线继续推进的结果,不是一夜之间从帽子里变出的兔子。
因此,把杨植麟称作“第二个震惊硅谷的人”,真正有价值的地方,不是制造天才之间的擂台,更不是把一天的股市波动包装成“一个人打穿美股”。
他与DeepSeek创始人带来的共同意义,是向世界证明,中国人工智能的突破不是孤零零的偶然事件,而是人才培养、基础研究、工程体系和市场应用共同作用的结果。
截至7月23日,K3仍要接受更广泛的第三方测试、真实业务检验和安全治理考验。技术越先进,越不能只顾跑分和热度,还要服务产业升级,守住安全、诚信与责任底线。
硅谷真正需要重新认识的,也许不是某一个名字,而是名字背后的中国创新生态。科技竞争不是一锤子买卖,更像一场接力赛。有人负责破风,有人负责追赶,还有人正悄悄把下一棒攥得更紧。
所谓“掉队”,很多时候只是旁观者等不及了。真正做技术的人,未必有空回应每一声嘲笑。等模型端上桌,争论自然会安静几分钟。
中国人工智能最值得期待的,也不是偶尔制造一次震动,而是把一次次震动,变成稳定、持续、负责任的创新能力。