RecodeX 重构消息,Reward AI发布通用操作策略OM-1(Omnibody Model 1),完全基于7自由度可穿戴手套采集的人类演示数据训练,未使用遥操作或机器人本体数据。该策略可在工业机械臂和人形机器人上以人类速度运行,学习一项新任务所需数据不足30分钟。其电磁手部追踪在67厘米/秒速度下过冲比视觉惯性方案低60%,并搭配独立时钟运行的强化学习控制层。目前权重、代码和API均未公开。
Reward AI发布OM-1机器人操作策略 仅用人类演示数据训练
更多报道Runtimewire ↗
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源Marktechpostmarktechpost.com
查看原文 ↗