算力贵了以后,中科曙光开始研究怎么让AI少算几遍中科曙光最近推出ParaCache,有一个思路挺值得关注:不是继续增加更多计算资源,而是尽量减少大模型重复计算已经处理过的内容。这其实对应了AI产业正在发生的一次变化。模型应用早期,行业首先解决的是“有没有算力”;当调用量越来越大,企业真正关心的就会变成“同样一批机器到底能服务多少用户”。多轮对话、知识库问答和智能体任务中,大量上下文会反复出现,如果每次都重新计算,本质上就是在烧钱。ParaCache尝试保存并复用已经完成的计算结果,就是从系统层面提高单位算力产出。这类技术未必像新模型发布那么吸引眼球,却更接近商业化阶段的真实需求。互联网历史上很多行业也是如此:用户规模扩大后,竞争从功能创新逐渐转向成本和效率。AI越普及,谁能减少一次重复计算,可能就等于多生产一部分利润。
