DC娱乐网

OpenAI这次不藏了,直接亮出“五菱宏光级”神仙芯片: 全新自研芯片“Jal

OpenAI这次不藏了,直接亮出“五菱宏光级”神仙芯片:

全新自研芯片“Jalapeño”(辣妹子)在DeepSeek R1解码测试中,每千瓦时吞吐量达到了NVIDIA旗舰GB300的104.3倍!

当老黄还在玩命堆功耗、把散热做成核反应堆级的时候,OpenAI用一枚功耗只有700W的小芯片,给功耗1400W的GB300和1200W的GB200结结实实上了一课。

在InferenceX公开基准测试中,设定在GB300的最佳用户延迟状态(每秒169.41个Token)时,Jalapeño每千瓦能轰出12258个混合Token,而GB300只有可怜的118个。

这感觉就像在赛道上,你开着十二缸、双涡轮、吃油像喝水的超级跑车,眼睁睁看着旁边一辆油耗只有你一半的五菱宏光,吐出100倍的数据,尾气的烟尘都把你淹没。

能省出这种数量级的电,秘密其实很朴素:OpenAI直接把KV缓存和模型状态给本地化了,极大减少了计算在预填(Prefill)与解码(Decoding)之间切换时的“数据搬运”。

AI芯片的天下,天下苦“数据搬运”久矣,老黄卖的是极其昂贵的“搬运工”,OpenAI干脆把厂房盖在了码头边。

更扎心的是,这块芯片从最初设计到最终流片(Tapeout),全流程只花了9个月。

靠的不是人类工程师加班熬夜,而是AI自己设计自己。

在某些特定计算块上,GPT-OSS生成的AI内核比人类顶尖专家手写的手艺还快上1.5到1.8倍。

AI不仅接管了画图、写代码,现在开始自己下场做铲子,还把老师傅的铲子打得稀碎。

OpenAI计划在今年年底前正式部署Jalapeño,二代芯片已经在全力研发,三代芯片甚至都画出了蓝图。

黄仁勋可能还没想明白,当最大客户突然变成最强对手,而且不仅不需要买你的GPU,甚至连你的HBM显存路线都给绕过去的时候,AI算力泡沫的刺破方式,居然是AI自己降本增效给挤掉的。

留给绿色巨人做皮衣的时间,真不多了。