横向比较会更直观。GPT-5.6 Luna已经做到每百万token输入1美元、输出6美元;DeepSeek V4 Pro更低至约0.44美元和0.87美元。假设一个任务消耗100万输入和100万输出token,Sonnet 5标准价格约18美元,GPT-5.6 Luna约7美元,DeepSeek V4 Pro仅约1.31美元。Claude相对Luna贵约2.6倍,相对DeepSeek则接近14倍。模型能力差距正在缩小,但价格差距却依然巨大。
真正值得思考的不是“Anthropic为什么不降价”,而是“Anthropic为什么敢不降价”。一种解释是,它认为企业购买的从来不是token,而是任务完成能力。一个Agent如果调用便宜模型需要反复推理5次、频繁tool call、不断修正错误,而Claude一次就能完成,那么即使单个token贵几倍,最终成本也可能更低。这就是比$/token更重要的指标:Cost per Successful Task。
这其实是Anthropic非常大胆的一场战略赌博。AI模型正在快速commoditization,单纯的知识问答、摘要、分类、信息抽取会越来越便宜。如果Claude未来只是“比其他模型好一点”,3美元/15美元的premium pricing会越来越难维持;但如果它能在Coding、复杂Agent、长任务和多工具协作中持续显著降低失败率、重试次数与人工介入,那么Anthropic就可能拥有类似高端软件的定价权,而不是被迫按照算力成本定价。
