DeepSeekV4Flash正式版上线DeepSeek把V4‑Flash正式版API放出来公测,这次升级特别反直觉,模型本身大小没改动,主要靠后期调优把Agent干活的能力直接拉上去。架构保持不变:模型继续采用MoE架构,总参数284B、激活参数13B,支持100万Token上下文,结构与尺寸与预览版完全一致。后训练优化:能力提升全部来自重新进行的后训练(Post-Training)优化,未堆砌参数规模。Agent能力增强:智能体能力大幅增强,在终端操作、工具调用、全栈开发等场景表现远超此前的V4-Pro预览版。DeepSeek V4-Flash正式版上线,不只是单一模型版本迭代,更是国产大模型行业从技术比拼走向商业化落地、从依赖海外算力走向软硬件自主共生的缩影。
