张一鸣据称亲自下场做世界模型,字节最快10月推出实时空间视频AI张一鸣这次据称亲自盯上了世界模型,彭博社援引知情人士称,他正在协调字节内部多个团队和算力资源,新模型最快可能在10月亮相。它不只是生成一段视频,而是要实时生成一个可以互动的虚拟世界,人说话或者移动身体,眼前的场景也能跟着发生变化。按照目前披露的信息,这套模型建立在Seedance技术之上,主要面向Pico头显,目标做到每秒约20帧,延迟约50毫秒,而且大量计算会放在云端完成。这意味着AI视频接下来比拼的可能不只是画面够不够真实,而是能不能一边生成,一边根据人的动作继续改变世界,游戏、直播和VR都会成为直接的应用场景。字节目前公开的Seedance 2.5已经能生成最长30秒的视频,官网也确实单独列出了多模态交互与世界模型团队,说明这个方向并不是突然冒出来的。不过现在还不能把10月发布当成板上钉钉,彭博的消息来自匿名人士,知情人士自己也表示时间仍可能变化,字节跳动目前没有公开回应
