DeepSeekV4Pro和Grok4.6谁更强差不多前后脚上线,这一波确实有点意思。一个是国产大模型里一直很能打的DeepSeek,一个是马斯克旗下Grok系列,两个模型放在一起比较,第一反应当然是看谁的跑分更高。但我觉得现在已经不能只这么看了。模型能力越来越接近以后,真正拉开差距的往往是复杂任务能不能做完、上下文能不能接得住、遇到问题会不会自己纠错。所以我更想看的是同一套任务让两个AI 模型直接“干活”,而不是看谁的榜单数字更漂亮。跑分是参考,能不能把事情办成才是答案。
DeepSeekV4Pro和Grok4.6谁更强差不多前后脚上线,这一波确实有点意思。一个是国产大模型里一直很能打的DeepSeek,一个是马斯克旗下Grok系列,两个模型放在一起比较,第一反应当然是看谁的跑分更高。但我觉得现在已经不能只这么看了。模型能力越来越接近以后,真正拉开差距的往往是复杂任务能不能做完、上下文能不能接得住、遇到问题会不会自己纠错。所以我更想看的是同一套任务让两个AI 模型直接“干活”,而不是看谁的榜单数字更漂亮。跑分是参考,能不能把事情办成才是答案。