过去一周,AI圈悄悄发生了一场无声的革命——不是新模型刷榜,而是战场换了维度。Sam Altman、李飞飞、张一鸣不约而同把重兵压向同一个方向:3D空间。当AI不再只是生成图片和文字,而是能造出一个你可以走进去的虚拟世界时,内容产业的底层逻辑正在被重写。
9月1日,Anthropic发布Claude Fable 5.1的同一天,李飞飞创办的World Labs推出了原生世界模型Atlas。9月3日,OpenAI正式发布GPT-6 Astra,它的演示震撼了开发者社区:给一段文字描述,Astra能独立在Blender里完成建模、贴图、渲染,再导入Unreal Engine 5生成一个可自由漫游的3D交互场景,全程无需人工介入。有人只给了一张房屋照片,AI就在Blender里还原了完整的室内空间,家具电器一应俱全,帧率接近游戏水准。
真正的爆点来自字节跳动。据彭博社9月7日报道,张一鸣亲自跨部门协调Seedance视频模型团队与Pico硬件团队,打造实时空间视频生成模型,最快10月亮相。用户戴上Pico头显后,可以移动、转身、开口说话,眼前的虚拟环境会实时响应——这不是预设场景,而是AI实时生成的世界。字节内部将世界模型列为2026年AI优先级首位,数据预算已达八位数人民币,是竞争对手的三到四倍。
三条路线,三种底色:OpenAI和Anthropic走的是LLM驱动路线,用大模型的推理和工具调用能力切入Blender、UE5等专业软件管线;World Labs是原生世界模型派,从物理仿真出发构建3D空间;字节跳动则走视频生成+硬件的融合路径。但殊途同归——它们都在回答同一个问题:AI能否成为"世界编辑器"?如果答案是肯定的,游戏开发、影视制作、虚拟社交的内容生产周期将从数月缩短至数分钟。
当AI开始搭建可进入的三维世界,屏幕不再是我们与数字内容之间的最后一道墙。这场空间计算的军备竞赛,才刚刚吹响开局号角。
AI 生成 . DeepSeek | 搜索综合