「AI」有人说显卡就是黄金,试图拔高显卡的地位,与人类文明共同认可的黄金等价。这可能是低估显卡了。因为黄金就是一块板砖,不增添利息,不产生价值,类似于抵押品,或者你拿它去拍别人的脑壳会比较顺手,拍完就可以留下作为赔偿。
而显卡接电后已经能源源不断产生智能,是一潭死水和涓涓细流的区别。显卡的上限在哪里,我目前已经看不懂了。我已经能看到,仅仅一张3090,一年就能生产千亿token了。这是基于我昨天实测数据的预估。而这仅仅是个开始。而这还是6年前的消费级显卡。
就在刚刚,我看到有人在3090上把Qwen-3.8-27B的输出速度提高到了380 token/s,又是5倍提速。相对于我最初实测的35 token/s已经提高10倍。这套技术方案是复用之前的输入,25K的短上下文。我不太认为这个380的速度是可用的,但这反映的是人们对于提效的狂热激情,几乎每天针对各种模型、各种硬件,都涌现出很多种方案。事实上,当几天前社区刚刚出现新的方案,我就让Codex去配置,不仅实现了,并且针对性的做修改。
目前大家都在用通用的执行器,理论上我也应该下载使用它们。但是当我只看到“我也要运行本地Agent”这个目标的时候,Codex这种嚣张的选手根本不会去选择第三方执行器,它直接帮我写了个新的。我现在非常担心,仅仅为了运行几个本地Agent,就一不小心重新开发了一个本地Codex。
这件事真正奇怪的地方在于,我一点儿也不认为“再造一个专用的Codex”是艰难的。正相反,它是一旦收不住,我就会涉足的地方。因此我刚刚跟AI说,一定要警惕所有东西都去自研。我目前随性玩,几乎除了基础模型本身,剩下的东西全部都在自研。这并不是我故意的。我只是对AI说,我想要某个功能,AI就帮我去造了。