DC娱乐网

#DeepSeekV4.1Flash发布# DeepSeek今天正式发布了V4.1 Flash,把"快速、专家、识图"三个开关整合到了一起。 这事儿得先说背景。DeepSeek 这家公司在国产 AI 里一直是个特例。 别的厂商发布新模型喜欢排场大、开大会、定名号。DeepSeek 更像个理工男,公告就是公告,直接说事儿。8月13日刚把开发者测 ​

DeepSeekV4.1Flash发布DeepSeek今天正式发布了V4.1 Flash,把"快速、专家、识图"三个开关整合到了一起。

这事儿得先说背景。DeepSeek 这家公司在国产 AI 里一直是个特例。

别的厂商发布新模型喜欢排场大、开大会、定名号。DeepSeek 更像个理工男,公告就是公告,直接说事儿。8月13日刚把开发者测试工具 Harness v0.1 用 MIT 协议开源了,上线不到 24 小时 GitHub 星标冲破 7 万。这次的 V4.1 Flash 也是同样的调调,发个邮件通知就开干了。

V4.1 Flash 到底干了什么?

先说最直观的变化:速度快。新模型用了一套新结构,推理延迟压到毫秒级,显存占用比上一代砍了 37%。换成人话就是,过去跑一段要等个几秒,现在基本是话没说完它就接上了。

然后是吃图能力。早期 DeepSeek 在视觉这块是短板,自家都承认有点"睁眼瞎"。转折点出现在 8 月 21 日——V4-Flash-Vision-Exp 多模态模型上线 API;8 月 31 日在 Hugging Face 开源,采用 MIT 协议(开源界最宽松的协议,想怎么用就怎么用),开发者可以下载模型自己部署。

数字怎么样?Agent 视觉任务里,准确率从 V4-Pro 的 72.3% 飙到 91.6%,多模态 Agent 能力已经接近闭源界公认的"多模态天花板" Opus-4.8。

V4.1 Flash 是把之前要手动切的"快速模式、专家模式、识图模式"三个开关合成了一个。用户不用再费劲选,发段文字它就当文字处理,发张图片它自动开视觉,全程不卡壳。

价格战这块 DeepSeek 一向卷得凶。9 月 10 日中午 12 点起新定价生效:

- 闲时(深夜、周末、工作日下午 12 点到 14 点):输入缓存命中 0.02 元/百万 token,相当于一分钱买 50 万字输入,便宜到几乎不要钱- 闲时输入 1 元/百万 token,输出 4 元- 高峰时段(工作日 9-12 点、14-18 点):价格翻倍,也就是输入最高 2 元、输出 8 元

这是峰谷分时定价的设计思路——把任务尽量挪到半夜和中午饭点跑,能省一半的钱。对中小企业开发者来说,账单可以缩水。

V4.1 Flash 一出,老将 V4 Pro 反而尴尬了。

DeepSeek 官方说得很直白:性能、费用、速度、总用时四个维度,新模型"全面超越"了 V4 Pro。所以 V4 Pro 安排在 9 月 14 日中午 12 点准时下线,原 V4 Pro 的请求会自动转到 V4.1 Flash,按新价格计费。

翻译一下:便宜的替代了贵的,慢的让位给快的,淘汰赛开始了。

那 DeepSeek 和海外顶级的差距还有多大?

单看综合实力,GPT-5 系列和 Claude Opus 4.6 依然是全球第一梯队,纯文本的天花板还是他们。但差距正在被一项项拆掉:多模态 Agent 能力 V4.1 Flash 已经能跟 Opus-4.8 掰手腕;价格是对方的几分之一到几十分之一;最关键的,开源。开发者可以下模型自己改、自己部署,海外巨头做不了的事,DeepSeek 做到了。

国产 AI 想要继续赶超,靠的不是再喊一次"对标 GPT"的口号,而是走两条路:一条是把模型做得便宜、快、能干活,让中小开发者和中小企业用得起;另一条是把生态工具铺好——开源协议、开发者工具、Hugging Face 上能跑起来的代码——让全世界用你的模型,是另一种意义上的领先。

V4.1 Flash 的"Flash"两个字,意思是闪电。

这一次,闪电落在了性价比的地板上。DeepSeekai创造营