🎯 科技 · AI大模型
🔥 张一鸣复出督战,字节跳动最快10月推出实时空间视频AI模型,目标让用户走进画面
9月7日,彭博社援引知情人士消息称,字节跳动正在开发一款实时空间视频生成AI模型,创始人张一鸣亲自监督该项目,协调跨部门团队与算力资源。模型最快有望于10月亮相,基于现有电影级视频生成模型Seedance构建。
与以往不同,这次张一鸣介入的是一个具体项目,工作内容涵盖协调不同业务部门、为项目调配AI资源与算力。截至发稿,字节跳动未就相关报道作出回应。但消息人士指出,模型的具体发布时间尚未最终确定,计划仍可能调整。
张一鸣淡出字节跳动日常管理已有多年。2021年,他先后卸任公司CEO与董事长职务,管理权杖交予梁汝波。此后外界对他的印象,更多停留在退休的创始人。这次亲自下场,说明字节对空间视频的重视程度非同一般。
过去几年,字节跳动对外讲的故事是算法推荐——让用户顺着信息流一条接一条看下去。如今,这位短视频巨头想把故事换一种讲法:让用户不再隔着屏幕旁观,而是直接走进画面里去。
新模型的目标不再是生成一段等待播放的视频,而是一个能随用户声音和动作实时变化的虚拟环境。字节内部给出的落地方向包括直播、短剧和游戏,并计划与自家Pico头显打通——当用户戴上头显,可以移动、转身、开口,而眼前的画面会跟着动作同步变化。
据i黑马报道,该模型以每秒20帧的速率按需生成视频,延迟约为0.05秒。模型通过将生成空间内容的计算任务转移至云端,有望降低头显设备对本地处理能力的要求,为成本更低、配置更简单的硬件设备打开发展空间。
值得关注的是,字节对世界模型的野心并非一时兴起。据媒体此前报道,字节跳动已将世界模型列为2026年四大AI优先事项之首,数据预算达到八位数人民币,是中国其他竞争实验室的三到四倍。公司内部定下的目标,是在2026年底之前至少推出一款世界模型。
Seed世界模型研究组同时推进两条路线:一条是面向机器人和具身智能的VLA,另一条是面向游戏和娱乐的3D仿真。字节从最熟悉的内容切入,可能把AI模型、云算力、内容平台和Pico硬件串联成飞轮。
从技术方向看,实时空间视频生成强调生成结果具备空间一致性,能够在视角移动、镜头变化或场景切换时保持物体和布局的相对稳定。相比普通文生视频,它对模型的推理速度、动态建模能力和画面可控性提出了更高要求,也更接近可在交互场景中直接使用的生成形态。字节跳动的入局,标志着AI视频生成从观赏时代正式迈入交互时代,内容产业的形态正在被重塑。
综合彭博社、驱动中国、i黑马报道 | 2026年9月9日