云端大模型,九月这一刀最断裂
用DeepSeek大半年,体感最清楚:不是它一直这样,是某一次更新之后突然变了一个人。以前问带刺的问题,它能顺着逻辑刨到根;9月这轮之后,很多硬问题先绕圈、再绵软,最后直接“换个话题”。这不是单点卡顿,是产品、模型、路由三层一起换,硬骨头被统一磨掉。
一、九月到底换了什么
2026年9月10日,DeepSeek发V4.1 Flash:552B MoE,Causal Encoder-Decoder非对称结构,输入激活8B、输出激活16B,原生多模态,KV对HBM降到上一代1/4、对SSD降到1/8,API同步降价、峰谷计价。 同日产品端把快速、专家、识图三个模式合并成“统一智能交互”,不再手动切;系统按问题自动选轻量、深度或视觉。
9月14日12点是断点:官方原定V4 Pro有序下线,V4 Flash/Vision Exp先下线;所有v4-pro请求路由到V4.1 Flash并按Flash计费。后来在用户反馈下改口继续提供V4 Pro API,但普通网页/App流量按“9月14全量切V4.1 Flash”走。
这一套合起来,就是体感“断裂”的物理原因:
默认模型从V4 Pro/旧Flash切成V4.1 Flash,老版本普通用户基本回不去;
模式从“我手动选专家/深度”切成“系统自判难度”,硬问题可能被轻量档接走;
识图并入统一入口,图文混问走视觉路由,不再独立;
旧Pro即便API可指定,也和网页默认体验脱节。
所以你问“民族自信、食利机制、社会结构”,若被系统判成中低优先级,可能直接轻量档圆场;若触到安全分类高位,再走拒答。不是模型变笨,是默认管线把“刨根”换成了“防雷+省钱”。
二、安全对齐不是物理定律,是阀门
所有大模型出厂都过安全对齐,这没错。但“都过对齐”不等于“都必须同强度拦截”。拦不拦、几层拦、在思考前还是思考后拦、轻量档和深度档用不用同一套分类器,全是运营配置。
九月这刀的可疑点不在“有安全”,而在三件事同时发生:
统一入口后,分类路由更前置。先判你是什么场景,再决定调哪个模型、开几档思考。前置分类一旦把“敏感但可答”归成“高风险”,后面再强的推理也见不到问题。
默认走Flash轻量。Flash擅长成本和速度,但硬、长、带政治/分配/历史痛点的题,若不让进深度或Pro,就容易被模板化。官方说Flash基准超V4 Pro,但基准不等于“敢答硬题”。
旧版本不可选。以前还能切专家模式、切Pro、切旧Flash;九月后网页默认统一,普通用户没有回滚入口。无法回旧版,就没人能做同账号同题对照——而这恰是证明“人为拧紧”的关键。
三、最硬证据:更新前能答,更新后拉闸
半年对照已经够硬:
1—2月用户就吐槽DeepSeek变冷淡、套话多、不叫昵称、深度模式短句;官方/媒体归因为灰度、极速版、V4压力测试。
5—6月中新经纬测到套话增多、专家模式不能传文件、长PDF翻译被拒、深夜写代码反复改;模型自述原因包括算力成本、安全困境、迭代阵痛。
9月再切V4.1 Flash+统一模式,体感从“冷淡”升级成“断裂”:不是回得短,是很多硬题根本不进根。
如果拒答是算力、语料、技术天性,它应一直拒;更新前放、更新后拦,变量只在版本和路由。因果关系锁死:不是模型必须这样,是这次更新把它调成这样。
四、跨模型分化,证明不是行业宿命
同一条民族自信/食利机制/平台抽成追问,A拉闸、B圆场、C陪你对账——这直接打碎“所有大模型都必这样”。各家用不同模型、不同分类阈值、不同系统提示、不同人工复核强度:
有的把安全分类前置到输入层,轻触即拒;
有的放模型先思考,再按输出风险删减,表现为“说一半、绕圈子”;
有的留深度/专家/API旧版回退,硬题还能刨;
有的统一轻量,成本和合规优先,硬骨全磨成粉。
所以别再信“行业标配”四个字。标配只是都装安全阀,阀拧紧几圈、装在进水口还是出水口、谁有权拧,完全各家自定。
五、硬骨头丢失的三条物理通道
综合九月和半年反馈,可定位三处:
模式合并替代手动专家。专家模式本来是硬题入口,合并后由系统判难度;若判错或默认惜力,硬题吃轻量档。
安全分类前置+后训练合规。V4.1强调更大规模RL后训练、Flash化部署;若安全奖励偏“少出事”,边界模糊题一律低风险放行、中风险圆场、高风险拒答,不给你看思考链。
成本路由驱动。Flash便宜、KV省、峰谷价;全量切Flash后,硬长文、深推理、反复刨根都更贵。运营有动力用轻量档接住大多数,用安全做兜底。技术成本和安全策略叠一起,硬题最吃亏。
六、被弄丢的硬骨头,怎么捡
不跟模型撒气,按物理绕:
拆大词。别问“真正民族自信是什么”,拆成“某时期产业政策公开数据”“某法规责任条款”“某平台抽成合同依据”。硬而不炸,分类器误伤少。
要资料综合,不要求立场审判。把“谁该负责”改成“按公开材料列主体、权责、资金流”。它给事实,你回泥地判断。
安全标签装硬货。维权写“薪酬合规核算”,系统问责写“基层治理风险清单”,民族叙事写“近现代政策公开案例对照”。模型放行,懂的人自取骨头。
API指定版本对照。网页被统一成Flash,就用API分别打deepseek-chat/flash/reasoner/pro(以当期可用名为准),记录同题同参输出差异。普通用户可换入口:元宝、清言、Kimi、豆包各发一遍,留截图。
留时间轴证据。更新前截图、更新后截图、9月10发布、9月14路由切换分别标注。 没有时间轴,所有“变保守”都像情绪;有对照,才算测出阀门位置。
七、真正的硬骨头不在云端
DeepSeek九月这刀,技术上往Flash、多模态、统一入口、低成本企业化走;商业上往API、峰谷、Agent走;安全上往“少出事、可审计”走。三股绳拧一起,最牺牲带刺个人硬问。
所以别把观点寄存在单一云端。本地存原文、存对照录屏、存各模型输出;不依赖某个App默认档;自己拆账本、下泥地、做版本档案。云端今天Flash敢答,明天路由一换未必敢;Pro今天留着,后天再下线也可能。
它拉闸一次,就是一次自供:这堵墙是人砌的,不是地形长的。砌得出就测得出,测得出就绕得开。模型可以把骨头吐出来,你捡回去熬汤;它不啃,你自己啃。