AI 资讯聚合 · 智能体

Reward AI 发 OM-1:只学人类演示的机器人策略,无遥操作无机器人数据

国外智能体机器人模仿学习Reward AI · 2026-09-14 · 约1分钟 · 来源:Reward AI 官方博客
Reward AI 发 OM-1:只学人类演示的机器人策略,无遥操作无机器人数据

机器人初创 Reward AI(团队此前有 DexCap、HumanPlus、ALOHA 的工作)发布 OM-1(Omnibody Model 1):一个通用操作策略,只从穿戴传感手套的人类演示学习,不使用遥操作数据、不使用机器人自采数据,随后以人类速度跑在工业机械臂与人形机器人上。

它挑战的是机器人基础模型的默认数据配方——遥操作/机器人数据把数据集绑定到单一本体;OM-1 按「一个模型、一个数据接口、任意本体」设计,主张今天的演示能训练尚不存在的机器人本体。Omnibody Hand 是 7 自由度可穿戴,围绕接触点选择、手中重定向、精细/力量抓握的功能设计。目前未开源:无权重、代码、数据集或 API。

原文链接:Reward AI 官方博客

核验记录
官方博客 rewardai.com/blog/OM-1 直读(列表页 time 2026-09,详情页无具体日);marktechpost 9/14 报道(datePublished 2026-09-14)交叉确认发布窗口;配图 om1-cover.png 实拉 200 PNG 1672x941;官方页未标注精确发布日,日期 9/14 以 marktechpost 报道日为口径,已在正文按发布口径记录