在 Databricks,AI 编码令牌支出正呈指数级增长。
1. “效率前沿”至关重要。在 Databricks 编码基准测试中,GLM 5.2、Opus 4.8 和 GPT 5.6-Sol 位于这一前沿:每美元的最佳质量。
2. 在将 Opus 5.0 与 4.8 比较时,我们看到了成本倒退。更新的模型并不总是意味着更高的效率。
3. 硬性预算是错误的原语。你最大的 AI 支出者可能也是你最能利用 AI 的工程师。
4. 没有适用于每个任务的最佳模型。路由、测试框架、评估以及开源和专有模型的正确组合可以彻底改变经济性。
我们正在大力投资这 4 个方面,既是为我们自己,也是为我们的客户。
