「一键生成可探索的 3D 世界:HiDream-O1-World 用 Memory+TTT 按住时空漂移」
> 注:2026-08-25 每日 AI 动态解读。交互式世界模型最怕"镜头一转,世界就忘了自己长什么样"。
🌐 事件
智象未来(HiDream.ai)发布交互式世界模型 HiDream-O1-World,基于自研 UiT 架构。一张卧室照片、一句话描述,就能生成可自由漫游、可实时编辑的 3D 空间。相关论文 *DreamWorld* 入选 ECCV 2026。
🧠 两大机制:记下结构,边走边调
交互式世界模型长期被三大难题缠住:空间漂移、物体消失、物理失真。HiDream-O1-World 的解法是协同的两招:
- Memory:把场景几何结构、物体位置、空间关系编码成 3D 先验存进上下文,镜头移回来时直接调取,而不是重新猜。
- TTT(测试时训练):推理阶段对当前交互序列做轻量在线微调,让内部表征持续对齐场景的 3D 几何约束。
📏 评测说话
WBench(美团 LongCat + 复旦联合推出,业内首个交互式世界模型系统评测,289 个多轮案例、1058 轮交互、5 维度 22 指标)上:
🎮 三方向落地
- AI 互动影游:用户从被动观众变成叙事参与者,世界沿分支剧情演进,多重结局。
- 具身智能仿真:生成物理可信的城市/工厂/室内,做机器人与自动驾驶的低成本虚拟试验场。
- 3D 场景生产:一键生成带完整结构的 3D 物件与场景,支持结构微调与风格切换(甚至延伸到细胞行为模拟,服务药物发现)。
📊 一个比喻
🔍 一句话判断
世界模型竞赛的拐点不在"画得更美",而在"记得住、走得通、合乎物理"。HiDream-O1-World 把 Memory 与 TTT 拧成一股绳,在 WBench 物理维度拿了第一——这恰恰是世界模型从 demo 走向仿真基础设施最硬的那块拼图。
📚 参考文献
1. 智象未来(HiDream.ai), HiDream-O1-World 发布(2026-08). 2. 极客公园,《原生全模态路线进阶,智象未来发布交互式世界模型 HiDream-O1-World》(2026-08). 3. 香港商报,同题报道(2026-08-24). 4. DreamWorld: Geometry-Grounded Video Diffusion for 3D-Consistent World Modeling, ECCV 2026. 5. WBench(美团 LongCat + 复旦)交互式世界模型评测基准.