DeepSeek 的多模态来了!vision-exp 直接挂在 flash 档,和文本版一个价:缓存命中空闲期 0.05元/百万 tokens,输出 4.5元,并发 2500。Pro 贵三倍,并发反而缩到 500。这个反差才是重点,视觉能力没有被当成溢价筹码。
过去视觉模型总要付“看图税”,不是按张计费,就是限流排队。DeepSeek 偏不,上下文 1M、输出 384K、Tool Calls 和 Anthropic API 全开放。把表格边框划掉,它真正的信号是:多模态不再是旗舰功能,而是默认配置。当对手还在用视觉版拉高客单价,DeepSeek 已经把“看懂图片”做成了文本同权的基建。
接下来的竞争不会只看谁更聪明,而是看谁先让多模态变成免费空气。
