Figure 03自主清洁147秒引关注,马斯克亲自下场追问

简介: Figure 03人形机器人搭载Helix 02模型,147秒全自主完成客厅清洁,无干预、无加速。其端到端神经网络实现感知-决策-控制一体化,凭真实家庭数据驱动技能迭代,展现卓越环境适应力与全身协同能力,加速人形机器人家用落地进程。

近日,全球估值达390亿美元的人形机器人独角兽企业Figure,发布了一段全新技术演示视频,其最新款人形机器人Figure 03搭载Helix 02模型,完成了一次时长147秒的全自主客厅清洁操作。

整个过程无人工干预、无画面加速,流畅完成凌乱客厅的整理任务,引发科技圈广泛关注。

该视频一经发布,便吸引了特斯拉CEO埃隆·马斯克的注意。他第一时间在社交平台发文追问:“这是自主工作还是远程遥控?对此,Figure创始人Brett Adcock明确回应:“完全自主,没有任何远程操控。” 值得注意的是,这距离Figure上个月发布机器人厨房整理演示视频,仅间隔一个月时间,其技术迭代速度备受瞩目。

非结构化场景考验:

客厅成为人形机器人的能力试金石

对人类而言,整理客厅是日常家务,但对人形机器人来说,这属于高难度的非结构化任务。散落的玩具、柔软易变形的抱枕、狭窄的室内过道、需要精细操作的遥控器等,每一项都对机器人的环境感知、动作规划和实时执行能力提出了极高要求,堪称人形机器人通用智能的“终极考场”。

在此次演示中,Figure 03的操作展现出极强的拟人化与灵活性,全程行云流水,尽显“家务能手”的特质:

在操作逻辑上,它遵循人类做家务的常规流程,先拿起喷壶润湿桌面,再用毛巾进行擦拭,擦拭完毕后,还能像人类一样将毛巾搭在肩上,腾出双手继续开展整理工作;遇到缠绕的毛巾时,可自主完成解开、重新定位的操作,无需人工辅助。

在全身协同方面,Figure 03展现出出色的资源调度能力——单手托举收纳盒的同时,另一只手能精准将积木舀入盒中;整理完成后,巧用腋下夹住收纳盒,空出双手捡拾沙发上的玩具。这种全身协同的操作逻辑,在此前Figure机器人“用胯顶抽屉、用脚辅助关门”的演示中,就已展现出初步优势。

面对动态场景挑战,Figure 03同样表现稳健:可将抱枕精准投掷回沙发,灵活调整遥控器方向并完成关机操作,在狭窄缝隙中侧身移动时,能保持动作连贯且不中断整理任务。这些看似简单的动作,背后实则考验着机器人的动态平衡能力与实时决策能力。

640 (2).gif

技术核心突破:

单一“大脑”控全身,数据驱动技能迭代

Figure 03能够实现流畅的自主清洁操作,核心得益于Helix 02模型的技术突破。与传统机器人需要为每个动作单独设计控制器的思路不同,Helix 02采用单一端到端神经网络架构,实现了感知与控制的深度统一——机器人头部的全景摄像头、掌心近距离相机及指尖触觉传感器捕捉到的像素信号,可直接输入该“大脑”,由其同步指挥全身关节做出相应动作,无需拆分控制模块。

更为颠覆的是其技能迭代方式。据Figure团队透露,此次演示中的所有新家务技能,均未通过编写新代码实现,仅通过为Helix 02模型补充新的训练数据,便完成了技能升级。

这种迭代模式与大语言模型的训练逻辑相似,数据积累越多,机器人的能力越全面。为获取真实家庭场景的训练数据,Figure已与全球顶级资管公司Brookfield达成合作,打造了大量实景家庭环境,用于模型训练与优化。

此外,Helix 02模型内置了负责物理本能的底层组件System 0,可替代传统手工编写的物理平衡代码,以每秒1000次的频率下达指令,像人类脊髓反射一样实时调整机器人的平衡状态,让其动作更自然、更稳健,避免了传统机器人动作僵硬、易失衡的问题。

家用落地展望:

从演示到普及,人形机器人加速走进生活

从上个月的厨房整理,到此次的客厅清洁,Figure在短短一个月内,将人形机器人的家庭应用场景进一步拓展。此次147秒全自主清洁演示,不仅是一次简单的任务完成,更是对人形机器人通用智能的重要验证,证明了“通用架构+海量数据”的技术路径,能够让机器人逐步适应复杂多变的家庭非结构化环境。

结合当前的技术迭代速度来看,人形机器人实现全屋自主整理已不再是遥不可及的目标。随着训练数据的持续积累,机器人将能够像人类一样,通过持续学习解锁更多家务技能,逐步打破“演示级”与“实用级”的壁垒。未来,当人形机器人能够稳定适配各类家庭场景,真正承担起日常家务时,人形机器人走进千家万户的愿景,将逐步照进现实,为人类生活带来更便捷的体验。

相关文章
|
6月前
|
人工智能 自然语言处理 API
阿里云轻量服务器部署 OpenClaw+配置百炼 API 步骤流程与避坑指南
OpenClaw(曾用名Clawdbot)是一款轻量化、可扩展的开源AI智能体执行框架,支持自然语言指令驱动、多模型灵活切换与全场景任务自动化。对于新手而言,阿里云轻量服务器凭借专属应用镜像、一键部署与稳定运行的特性,成为部署OpenClaw的最优选择,无需复杂环境配置,即可快速搭建7×24小时在线的AI服务。接入阿里云百炼API后,可无缝调用千问Qwen3-Max、Qwen3.5-Plus等大模型,实现高效文本处理、长上下文理解、代码生成与多模态交互。
1055 4
|
4月前
|
人工智能 安全 测试技术
Qoder使⽤最佳实践
Qoder重塑AI编程范式:从“写代码”转向“定义意图”。强调任务拆解、精准提示词、上下文工程、智能模型选型等12大实践,集成自动优化、Rules规范、MCP扩展与Spec驱动开发,助开发者高效产出高质量代码。
|
存储 编解码 iOS开发
视频文件格式:MOV与MP4格式的区别是什么?
视频文件有多种格式,很多人在下载时不知道该选择哪种文件格式。不同格式有不同特点,各自有优缺点。本文将详细介绍常见的MOV和MP4的特点与区别,以供读者了解及选择。
11817 3
视频文件格式:MOV与MP4格式的区别是什么?
|
8月前
|
数据采集 人工智能 监控
告别“垃圾进垃圾出”:打造高质量数据集的完整指南
本文深入解析AI时代“数据比算法更重要”的核心理念,系统阐述高质量数据集的定义、黄金标准(含16条可操作规范)与七步构建法,并提供自动化检查、基线验证及人工评审等实用评估手段,助力开发者高效打造可靠、合规、可持续迭代的优质训练数据。(239字)
2767 12
|
11月前
|
数据采集 JSON JavaScript
Cypress 插件实战:让测试更稳定,不再“偶尔掉链子”
本文分享如何通过自定义Cypress插件解决测试不稳定的痛点。插件可实现智能等待、数据预处理等能力,替代传统硬性等待,有效减少偶发性失败,提升测试效率和可维护性。文内包含具体实现方法与最佳实践。
|
5月前
|
人工智能 弹性计算 关系型数据库
阿里云企业新用户定义及专属优惠政策解读
阿里云面向企业新用户推出多重专属优惠:需完成企业实名认证、无历史付费记录、同一主体仅享一次。涵盖38元/年起的轻量服务器、199元/年u1实例、5亿算力补贴、最高4万元AI抵扣金及10万元出海资源包,助力中小企业降本增效、快速上云。
531 12
|
7月前
|
人工智能 算法 机器人
100亿、18个知识点,读懂今晚这场AI春节档
农历2025年除夕,一场近100亿的AI营销大战正酣,却遭遇监管“重拳”——市监总局约谈阿里、腾讯等七大平台,发布《反垄断合规指引》。监管意在遏制内卷式竞争,推动AI竞争从流量争夺转向价值创新。
340 1
|
JSON 缓存 并行计算
NVIDIA 实现通义千问 Qwen3 的生产级应用集成和部署
阿里巴巴近期开源了通义千问Qwen3大语言模型(LLM),包含两款混合专家模型(MoE)235B-A22B与30B-A3B,以及六款稠密模型(Dense)从0.6B到32B不等。开发者可基于NVIDIA GPU使用TensorRT-LLM、Ollama、SGLang、vLLM等框架高效部署Qwen3系列模型,实现快速词元生成和生产级应用开发。
|
机器学习/深度学习 人工智能 数据可视化
生成AI的两大范式:扩散模型与Flow Matching的理论基础与技术比较
本文系统对比了扩散模型与Flow Matching两种生成模型技术。扩散模型通过逐步添加噪声再逆转过程生成数据,类比为沙堡的侵蚀与重建;Flow Matching构建分布间连续路径的速度场,如同矢量导航系统。两者在数学原理、训练动态及应用上各有优劣:扩散模型适合复杂数据,Flow Matching采样效率更高。文章结合实例解析两者的差异与联系,并探讨其在图像、音频等领域的实际应用,为生成建模提供了全面视角。
3909 1
生成AI的两大范式:扩散模型与Flow Matching的理论基础与技术比较