DC娱乐网

暴降98%成本: 千问发布全模态Omni 阿里的 Qwen 团队又端出新东西了, 这次发的是原生全模态大模型 Qwen3.8-Omni-Flash — 真正的大一统全模态 不仅是能听会看, 官方强调它是原生打通了图、文、音、视频输入, 并塞进去了 1M tokens 的长上下文. 实测在音频表现上直接压过了谷歌的 Gemini 3.8 Flash. ​

暴降98%成本: 千问发布全模态Omni阿里的 Qwen 团队又端出新东西了, 这次发的是原生全模态大模型 Qwen3.8-Omni-Flash

— 真正的大一统全模态不仅是能听会看, 官方强调它是原生打通了图、文、音、视频输入, 并塞进去了 1M tokens 的长上下文. 实测在音频表现上直接压过了谷歌的 Gemini 3.8 Flash.

— 骨折级降本与 Token 压缩API 的音频输入单价暴跌了 98%, 音视频降了 93%. 最秀的是它看视频不用逐帧死磕, Agent 自己会快进找关键帧, Token 消耗硬生生砍了 45.7%.

— 实时版与空间音频感知同步上的 Realtime 实时版本, 居然能结合视觉去感知环境空间里的声源方位和距离, 真正做到了听声辩位.

白菜价的 API + 官方直接开源了配套的 Live Harness 脚手架, 应该体验还不错。

🔗 官方博客: qwen.ai/blog?id=qwen3.8-omni-flash

QwenQwen38全模态Agent大模型降价