DC娱乐网

刚准备骂腾讯抠搜,转头看见这个,我又把嘴闭上了。前两天我还提醒大家赶紧薅羊毛,他

刚准备骂腾讯抠搜,转头看见这个,我又把嘴闭上了。前两天我还提醒大家赶紧薅羊毛,他们的Hy4 Preview 9 月 10 号免费结束。

果不其然,今天 11 号免费就没了,切回去要 0.29 倍积分,比我平时用的 GLM-5.3-Flash 贵了快五倍。

我一边把模型换成差点意思的 Hy3,一边准备开骂。结果往下翻,Hy3 下面躺着一个 DeepSeek-V4.1-Flash,标着“独家优惠”,积分只要 0.03 倍,全 WorkBuddy 最划算的就是它。

我仔细查了一下,这模型是怎么来的,比 0.03 倍有意思多了。

DeepSeek 这次发布安静得有点过分。9 月 8 号内测,没有发布会,没有预热海报,模型就这么悄悄出现。调用方式更懒,什么都不用改,几乎是把模型名换成 deepseek-v4.1-flash就能用。

9 月 10 号正式版上线,官网发篇文章,Hugging Face 传份技术报告,完事。

真正让开发者炸锅的是另一件事:V4.1 Flash 上线当天,所有发往 deepseek-v4-pro 的请求被悄悄路由到 Flash,按 Flash 的价格计费。通知是社区群发的,前后不到 48 小时。

OpenAI 当年关停 Sora API,提前 6 个月就发了正式公告。

有人叫好,白捡的升级,便宜还更快;也有人不乐意,生产环境的工作流是按 V4 Pro 调优的,监控阈值、prompt 调校、失败处理全得重来,说换就换,跟半夜被人搬了家差不多。

性能倒是真能打。552B 的 MoE 模型,全新非对称架构,输入激活 8B、输出激活 16B,测试数据里吞吐量比 V4 Pro 高约 6 倍,首字延迟从 766 毫秒降到 178 毫秒,基准测试超过了 V4 Pro、GLM-5.3、Kimi K3 这些旗舰。KV Cache 对 HBM 的需求也降到上一代的 1/4。

DeepSeek 官网直接把 WorkBuddy 写成了“官方合作伙伴”,国内版全量上线还给了两周限时折扣。

DeepSeek 出模型,腾讯出流量入口,“模型厂商加工具平台”这套组合,大概率就是国产大模型接下来落地的主要打法。

所以回到开头那个 0.03 倍,价格是真便宜,但便宜背后这套“不开发布会、把钱全砸到价格上”的路子,才是更值得琢磨的地方。

你们觉得呢?这种直接降价上线、公告都懒得好好发的打法,是真效率,还是对开发者的不负责?