LTX-2.5 来了,开源狂欢。
核心升级
新扩散视频解码器:官方叫 Diffusion Fidelity Rendering,按场景复杂度分配渲染算力,减少高动态伪影,文字、人脸细节更稳
原生多镜头生成:整段序列一次渲染,角色、场景、声音跨镜头保持一致,不再靠后期拼接
定制 Gemma 4 语言骨干 + 提示增强器:复杂多主体提示更准
面向物理 AI / 机器人的预训练检查点:给机器人仿真等领域直接微调用
蒸馏版大升级:可在本地显卡和 Mac 上以更低显存运行
10 秒 720p 图生视频只要 6.8 秒,快过实时播放
LTX 托管 API(1080p):同任务 23.7 秒
Gemini Omni Flash 52 秒、Grok 1.5 63 秒、Veo 3.1 70 秒、MiniMax H3 180 秒、Seedance 2.5 317 秒、Kling 3.0 Pro 398 秒
成本约为同类八分之一;Fast 档 720p 带音频每秒 0.09 美元,10 秒片段约 0.9 美元
官方盲测胜率 67%,领先 Seedance 2.5(65%)和 Gemini Omni Flash(55%)。但 Artificial Analysis 竞技场榜单目前还没收录 LTX-2.5。
年经常性收入低于 1000 万美元的组织可免费商用、修改、自托管、再分发;大厂需单独授权。没有强制水印,但要求披露内容由 AI 生成,禁止军事/武器用途,也禁止用模型训练竞争性 AI 系统。
