Hehson科技讯 9月7日晚间消息,今日,智象未来发布具身世界模型HiDream-O1-Embodied。该模型强化了机器人物理感知与动态预判能力,可助力具身智能实现更高阶的物理交互。在具身智能模型评测平台RoboColiseum上,HiDream-O1-Embodied在核心的Robustness(扰动适应)子榜单中,以平均分0.692的成绩登顶榜首。
据悉,HiDream-O1-Embodied以0.692分成绩登顶榜首,得益于其原生全模态底座——为跨模态理解与生成提供了基础。而在执行环节,为了保证在真实世界的各类 “意外”中保持稳定。HiDream-O1-Embodied在语言理解、视觉感知、高容错机制三项核心能力上进行了突破性创新,让理解更精准、感知更稳健、抗干扰能力更强。
语言理解层面,HiDream-O1-Embodied覆盖多元动词、句式与表达方式的等价指令空间,不被句式束缚,只锁定意图本身。无论指令如何变换,它都能穿透字面,直达用户的本意。
视觉感知层面,物理世界中机器人的视觉通道并非是理想状态。相机位置可能发生偏移,标定精度会随时间变化,单路画面也可能受到遮挡或干扰。HiDream-O1-Embodied综合多个视角的信息,让不同视觉通道相互补充,而非依赖某一固定视角。当部分视觉信息出现偏差或暂时不可用时,模型仍能借助其他视角理解场景、判断任务并继续执行,让系统从“一处失灵、全局失效”,转变为“局部受限、整体仍可运行”。
高容错机制层面,真实世界中光照变化、画面污损、视野遮挡、信号波动,都是机器人实际运行时可能遇到的日常情况。HiDream-O1-Embodied在训练阶段便主动引入多种非理想条件,让模型反复面对不完整、不稳定的信息,并学会从有限线索中作出可靠判断。这样的训练使模型不只追求理想条件下的最佳表现,也更加重视复杂环境中的持续稳定。(文猛)