刚刷到 GPT-6 Sol 和 Claude Opus 5.5 的消息,第一反应不是“谁赢了”,是:怎么又赶在一块儿了?本来还想把手头常用的模型摸熟一点,这下待试清单又加了两行。
尤其写代码时,光看发布介绍真选不出来。一个任务能不能从头做到尾,改完会不会顺手检查一遍,遇到含糊需求是直接猜还是先问清楚,这些用半天比看一堆口号有感觉。两家几乎同时上新,倒给了个好借口:把同一份真实工作丢给它们试试。
我现在最想看的不是“谁把谁秒了”,而是日常那些琐碎活:改一段旧代码、补一份说明、收拾一堆杂乱资料,到底哪边让我少返工。你们要是已经用上了,先说说哪件小事让你明显感觉到差别?
AI 大模型
