Gemini 3.6 Flash刚发布,我就在X上看到不少用户的真实评价。发布仅一天(7月21日正式上线),用户实测反馈远超基准宣传的“效率提升”。负面声音更多,X上“失望”“回归”“hype落空”成为高频词,实测体验与Google宣传的“工作马力升级”存在明显差距。
具体帖子里,有用户用复杂3D可视化任务测试,发现模型多次忽略明确指令,先尝试App内模拟、再乱放网页图片,最终生成结果质量甚至低于半年前的Gemini 3.1 Pro版本。
还有开发者反馈,在多步agent工作流中,工具调用出现异常,直接把function call打印成可见文本而非实际执行,导致任务中断。部分日常用户则指出,回答风格明显变冷淡简洁,虽节省了token,但互动感和亲和力下降,不少人已手动加prompt要求更详细,或直接切回旧版使用。
当然,X上也有中性声音认可其输出token减少约17%、编码基准(如DeepSWE)有所提升,以及API价格更具优势,适合高频简单任务。
但整体来看,这些改进在真实复杂场景下的体现有限。从X上众多用户的反馈情况来看,Gemini 3.6 Flash目前定位仍是高效Flash系列的迭代版,在速度和成本控制上有所进步,但在指令遵循、工具可靠性和创造性输出方面,距离用户预期和Google宣传的“升级”仍有距离,更适合轻量日常场景,而非高要求专业工作流。谷歌Gemini3.6什么水平


