跳到正文
原文
arXiv · 多模态、视频与世界模型· Zhihao Zheng·· 3 天前AI 评分46

Social-WM:面向机器人社交导航的安全感知潜在世界模型

Social-WM: Safety-Aware Latent World Models for Robot Social Navigation

AI 导读

Social-WM 提出一种基于第一视角 RGB 视频训练的高效潜在世界模型规划框架,通过预测动作实际执行后的未来并建模可实现性,在执行前评估社交导航安全风险。在 Social-HM3D 上成功率达 63.77%,人类碰撞率降至 21.67%,无需显式行人跟踪、特权人类状态或在线强化学习,并能零样本迁移至 Social-MP3D。

来源:arXiv · 多模态、视频与世界模型 · arxiv.org