8月17日,落户合肥高新区的智象未来(HiDream.ai)正式推出原生全模态交互式世界模型HiDream‑O1‑World,在时空一致性、物理一致性两大行业难题上取得重要技术突破,第三方权威评测榜单首次参评便登顶,为安徽生成式人工智能产业再添硬核创新成果。

交互式世界模型被视作人工智能迈向理解真实物理世界的关键赛道,长期面临场景漂移、物体形变、违背物理常识、长时序记忆缺失等技术瓶颈。智象未来HiDream‑O1‑World依托自研原生全模态UiT架构,实现漫游、编辑、交互三大核心功能,支持文本、图像、交互操控多模态输入,可一键生成时空连贯、遵循物理规律、支持长时推演的完整虚拟世界。镜头推拉摇移过程中,场景几何结构稳定,物体不会出现消失、变形问题;物体碰撞、遮挡、重力响应贴合现实因果逻辑,告别传统模型简单拼接画面的弊病。
在美团LongCat团队联合复旦大学打造的业内首个交互式世界模型评测基准WBench榜单中,HiDream‑O1‑World首次参评拿下Navi分榜榜首,平均分达80.9分;其中物理维度73.3分、一致性维度88.0分,两项核心指标位居前列,刷新国内交互式世界模型性能水平。该评测基准包含289个多轮交互案例、1058个交互轮次,从五大维度22项指标完成量化测评,Navi分榜更是衡量模型空间理解能力的核心标尺。
据智象未来CTO姚霆介绍,交互式世界模型核心价值不只是生成逼真三维场景,更在于让AI深度理解空间深度、物体质感、运动惯性与光影逻辑,完成对物理世界运行规律的认知重塑。HiDream‑O1‑World正是这一技术路线落地的重要载体。
技术层面,模型通过“3D先验注入Memory上下文+Test‑Time Training在线维护”协同方案攻克长时程时空一致性难题,依靠空间记忆上下文留存场景几何信息,推理阶段轻量在线自适应优化,有效解决视角切换带来的场景漂移、物件凭空消失痛点。在物理一致性上,企业从训练数据、推理机制双向发力,借助物理模拟合成数据强化模型学习,同时将TTT在线适配机制延伸至物理场景,相比行业平均水平,视觉合理性提升13.6%,因果保真度提升12.7%。相关空间一致性研究论文DreamWorld: Geometry‑Grounded Video Diffusion for 3D‑Consistent World Modeling成功入选计算机视觉国际顶会ECCV 2026。
在应用场景上,这款世界模型打开多产业创新空间。面向AI互动影游,可打造分支剧情随用户探索动态演进的沉浸式叙事体验;面向具身智能仿真,能够构建高保真虚拟试验环境,服务机器人、自动驾驶仿真测试;面向创意设计,赋能家居、艺术空间快速生成迭代;同时还可拓展至微观仿真,为药物研发、生命机理模拟提供全新数字工具。
作为扎根合肥高新区的AI创新企业,智象未来持续深耕视觉多模态基础模型研发。此次HiDream‑O1‑World的发布,是安徽本土AI企业在世界模型前沿赛道的重要实践,将助力我省人工智能产业强化原始技术创新,拓展AIGC产业落地边界。