字节跳动正悄然布局一项前沿技术领域——实时空间视频生成AI模型,这一动作被视为其正式进军世界模型赛道的重要标志。据内部消息,该模型有望在机器人技术、自动驾驶等新兴应用场景中,与meta、Alphabet等科技巨头展开直接竞争。
该项目由字节跳动创始人张一鸣亲自挂帅,统筹协调跨部门资源,集中AI研发团队与算力资源全力推进。知情人士透露,模型最快可能于下月正式发布,但具体时间仍存在调整可能。截至目前,字节跳动官方尚未对此事作出回应。
这款新模型以字节跳动现有的电影级视频生成AI模型Seedance为基础,核心功能是构建可交互的虚拟世界。其应用场景涵盖直播、短剧制作以及游戏开发等领域。张一鸣的设想是,通过整合字节在视频技术领域的深厚积累,将TikTok庞大的创作者生态引入世界模型领域,形成新的技术生态闭环。
此次布局是字节跳动内部战略调整的关键一步。公司正将大量ToB业务资源向视频制作与生成赛道倾斜。这款空间视频模型被定位为类似谷歌Genie的产品,旨在打通AI技术、云计算资源与内容平台生态,同时与旗下XR品牌Pico的硬件布局形成联动效应。
从技术路线来看,字节跳动与谷歌均选择以视频为核心构建世界模型,目标是为AI智能体提供逼真的物理环境模拟。谷歌今年早些时候推出的Genie已实现用户与实时渲染虚拟世界的交互功能。这类空间模型被视为机器人、自动驾驶等领域的底层关键技术,张一鸣的入局意味着他将与李飞飞、杨立昆等顶尖研究者共同探索视觉AI的技术边界。
若该模型顺利落地,字节跳动将在XR硬件领域之外,与meta、苹果开辟新的竞争维度。当前,meta正围绕Quest系列头显构建大众级XR生态,苹果则通过Vision Pro布局高端空间计算市场,两者在主流市场渗透过程中均面临挑战。而空间AI模型或将成为决定行业格局的下一个核心竞争点。




















