斯坦福团队发布 OM-1!一套模型,适配所有机器人

简介: 斯坦福团队Reward AI发布首款通用机器人基础模型OM-1,首创“学人类动作、适配全硬件”范式:无需机器人数据与微调,支持桌面/工业/人形机器人零样本泛化,30分钟学会新任务。双层解耦架构实现智能与硬件解耦,有望破解具身智能规模化落地难题。

具身智能最大的痛点,终于有人开始破解了。

机器人行业长期存在一个硬伤:不同品牌、不同类型的机械臂、人形机器人,硬件结构完全不同。以往必须针对单台设备单独采数据、单独训练模型、单独调参,成本高、周期长,根本无法快速规模化落地。

能不能做出一套通用模型,适配所有机器人?

9月15日,斯坦福学生创办的AI机器人公司Reward AI给出了最新答案:正式推出首款通用机器人基础模型 OM-1(Omnibody Model 1)。

图片

官方宣称,该模型支持零样本跨硬件泛化,可直接适配桌面机械臂、工业机械臂、人形机器人,无需微调、无需重训。

1►

斯坦福硬核团队,深耕机器人具身智能

Reward AI 由斯坦福大学学子 Zipeng Fu、Chen Wang 联合创立,团队深耕机器人控制与具身智能领域,技术积淀扎实:

✅ Zipeng Fu:斯坦福AI实验室博士,曾任职谷歌DeepMind、卡内基梅隆大学机器人研究所,专注机器人全身智能控制研究;

图片
✅ Chen Wang:主导研发DexCap便携式动作捕捉系统,为OM-1核心技术奠定前期基础。

图片
2►

核心革新:不学机器人数据,直接学人类动作

目前行业主流方案高度依赖机器人遥操作数据:人工操控设备示范,机器人记录自身运动数据训练模型。这种方式最大的问题是模型绑定硬件,换一台机器人就要全部重来,效率极低。

图片
OM-1 彻底换了一条技术路径:不依赖机器人本体数据、无需遥操作,只通过学习人类自然动作,掌握通用操作能力。

团队自研 7自由度可穿戴设备Omnibody Hand,操作人员佩戴设备完成日常操作,即可同步采集视觉、姿态、触觉、发力力度等多模态人类动作数据。

图片

基于这套数据,OM-1实现两大核心能力:

  1. 全硬件零样本适配:一套模型直接适配桌面、工业、人形机器人等多类硬件,无需二次训练微调;

  2. 极速学习新任务:仅需30分钟以内的人类演示数据,就能掌握复杂长时序操作。

根据官方演示视频,OM-1可稳定完成精细抓取、网线插拔、叠衣服、调酒、多臂协同包装等生活化、工业化场景任务。

3►

双层解耦架构,实现跨硬件通用

OM-1能够打破硬件壁垒,核心是独创的双层解耦技术架构,把“思考逻辑”和“硬件执行”彻底分开:

图片

🔹 上层通用策略层:从人类动作数据中学习通用操作逻辑、力度控制和作业规律,形成不绑定任何硬件的智能决策能力;

🔹 下层自适应控制层:通过强化学习适配不同机器人的动力学特性,自动抵消作业扰动,将通用指令转化为对应设备的精准关节动作。

官方测试显示,模型在高速作业场景下误差显著降低,能够高度还原人类细腻的操作节奏与力度。

4►

行业价值:告别“一机一模型”内卷

当前人形机器人、工业机器人落地难,核心瓶颈就是数据碎片化、硬件不通用、成本居高不下。

图片

OM-1的核心价值,是实现了机器人智能与硬件的解耦。模型学习的是人类通用的物理操作逻辑,而非单台机器人的运动方式。

这不仅能适配现有机器人设备,还可前瞻性适配未来新硬件,极大降低机器人研发与落地成本,为行业规模化提供全新路径。

5►

客观视角:技术亮眼,落地仍待验证

理性来看,截至目前 OM-1 仅为官方技术发布:模型权重、代码、数据集、相关论文均未公开,各类任务的成功率、稳定性等核心实测数据也未披露。其中第三届中国具身智能与人形机器人创新峰会的时间为2026年12月22-23日,部分会议主题:诠释全球产业格局趋势,解析国家顶层政策与十五五规划,未来3年具身人形机器人产业红利导向,全产业链统一标准、接口互通、合规量产规范化,国产具身智能与人形机器人万台规模化量产元年路径,核心零部件与关节模组,具身智能大小脑协同与算法,灵巧手、整机研发与工艺升级,特种机器人与服务机器人场景规模化应用,大会组委会:赵靖 一八一零一六二三一六九。

其宣传的零样本泛化能力,尚未经过第三方权威基准测试,真实落地效果、复杂场景鲁棒性、工业级适配能力,仍需要时间验证。

6►

结语

OM-1的出现,打破了机器人行业“一台硬件、一套模型”的传统内卷模式。

以人类动作为师、通用能力赋能全硬件,这套全新范式,有望大幅降低具身智能落地门槛,加速人形机器人走进真实生产、生活场景。

本文内容整合自公开行业信息,仅作交流分享使用;相关内容版权归原作者所有,若涉及侵权请联系删除。

相关文章
|
22小时前
|
Web App开发 传感器 编解码
云手机与指纹浏览器在Lazada运营中的分工解析
Lazada东南亚六国站点(新、马、泰、菲、越、印尼)本地化差异大,共用设备/网络/操作习惯易被平台关联判罚。需“一站点一环境”:独立指纹浏览器(源码级Canvas/WebGL/WebRTC等配置)+ 云手机(真实Android实例+本地运营商)+ 本地住宅/移动代理,确保时区、语言、IP、行为全匹配。
|
3月前
|
存储 弹性计算 安全
阿里云服务器收费标准与活动价格:2026最新ECS、轻量、GPU价格与优惠解析
本文整理了阿里云服务器(ECS)、轻量应用服务器及GPU云服务器的2025年最新收费标准与活动优惠。轻量应用服务器2核2G配置低至38元/年,性价比突出;ECS经济型e实例2核2G活动价99元/年,人人可享且续费不涨价;2核4G企业专享199元/年,2核8G经济型月付162元起。GPU云服务器方面,A10卡GN7i实例32核188G活动价3213.99元/月起。
|
3月前
|
人工智能 编解码 API
阿里云HappyHorse视频生成模型深度解析:限时6折+Token Plan省钱攻略全指南
阿里云AI视频生成模型HappyHorse-1.1已上线,支持文生视频(t2v)、图生视频(i2v)及多图参考生成(r2v),适配广告、电商、短剧等场景。享专享6折(720P仅0.54元/秒)、包季4.5折节省计划及Token Plan企业方案,阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 开通百炼即赠10秒免费体验
2434 0
|
2天前
|
供应链 安全 JavaScript
输入法应用嵌入浏览器漏洞的攻击链研究
CVE-2026-51990是搜狗输入法Windows版的一键远程代码执行漏洞,由URI参数注入、WebView导航失控及过时无沙箱Chromium 80引擎三缺陷串联构成。攻击者诱导点击即可部署GrayRabbit后门。腾讯已发布补丁限制协议参数与域名,但底层引擎风险犹存。(239字)
152 1
|
1天前
|
Rust 安全 编译器
Whim 是什么?一门把 PHP 被否决的设想真跑起来的实验语言
Whim是一门实验性编程语言,源自对PHP未被采纳特性的探索。它受PHP启发但不兼容,拥有丰富类型系统、模式匹配等现代特性,旨在低成本验证语言设计想法,而非替代PHP。(239字)
28 1
|
1天前
|
人工智能 机器人 开发者
真香!机器人终于不只会回消息:3.3 万 Star AstrBot 把多平台、插件和 Agent 拧成一套开源底座
AstrBot 是一个开源的一体化 Agent 聊天机器人平台,把 QQ、企业微信、微信公众号、飞书、Telegram、Slack 等平台接入同一个 Agent 工作台。
|
1天前
|
数据采集 搜索推荐 测试技术
站点改版后搜索收录掉了一半:robots、sitemap与爬虫抓取的排查修复实践
站点改版后搜索收录掉了一半,问题往往不在内容,而在抓取与索引环节。本文按“能不能抓、能不能解析、愿不愿收录”的顺序给出可复用排查流程:伪装爬虫自测返回状态、核对robots是否误伤、检查sitemap与内链可达性、canonical规范化、旧地址301迁移、避免误封搜索引擎爬虫,并说明用自助建站平台时哪些SEO规则由平台生成、哪些需要自己核对。
|
1天前
|
JSON 安全 API
图片鉴黄与鉴暴恐-图片内容安全审核-图像敏感内容筛查-图像违规内容识别接入教程
图片内容安全审核接口用于对单张静态图片进行机器判定,自动识别其中可能包含的色情与暴力恐怖两类不适宜内容。调用方通过一次 POST 请求提交图片来源(图片 URL、base64 编码或图片文件),接口以 JSON 返回判定结果,可嵌入 UGC 审核流水线、内容平台发布前校验、企业素材库入库质检等环节。接口支持 PNG、JPG、JPEG、BMP 四种常见格式,单张不超过 4M,不支持 GIF;鉴别类型由 type 参数指定(1=色情,默认;2=暴恐)。鉴权采用 API 简单身份认证(APPCODE),机审结果建议作为人工复核的输入而非唯一处置依据,高风险场景需叠加人工机制。
28 0
图片鉴黄与鉴暴恐-图片内容安全审核-图像敏感内容筛查-图像违规内容识别接入教程
|
2天前
|
缓存 人工智能 运维
DeepSeek Harness完整更新实操手册:本体三种升级方式、插件独立更新、故障排查全流程
DeepSeek Harness简称dsh,是一套插件化架构的开源Agent运行框架,目前处于开发者预览阶段,项目迭代节奏很快。新版本除新增功能特性之外,还会修复安全缺陷,部分迭代版本会存在不向前兼容的破坏性改动。大量使用者升级时很容易混淆**本体程序**和**插件扩展**两套独立体系,误以为更新本体程序,插件就会自动同步升级,最终出现Web界面报错、插件加载失败、会话异常、功能不可用等各类故障。
103 0
|
2天前
|
人工智能 运维 API
从零到一,DeepSeek Harness开发实战:四种预设模式详解、插件安装卸载、常见报错故障排查全解
在大模型应用快速迭代的今天,单纯的对话API只能够完成文本输出,想要让AI具备读写本地文件、执行终端脚本、多步骤任务拆解、子智能体调度的真实操作能力,就离不开Agent运行底座。2026年8月正式开源的DeepSeek Harness(简称DSH),凭借**Agent = Model + Harness**核心理念迅速收获大量开发者关注。大模型是智能体的思考大脑,而Harness就是执行手脚,负责环境感知、工具调度、会话生命周期管理、沙箱隔离、任务循环、子Agent调度。项目依托Cordis微内核,贯彻“一切皆插件”设计思想,模型适配器、工具集、存储、Web前端界面全部以插件形式实现,无需修改
101 0