机器人训练组合拳 小米发布基座模型Robitcs
小米在最近三天,机器基座集中展示了在机器人具身领域的人训成果,在亮出人形机器人工厂成绩单、练组开源发布具身生成模型Xiaomi-Robotics-U0过后,合拳具身基座模型Xiaomi-Robotics-1也宣告正式发布。小米
PChome 7月16日消息,发布小米在最近三天,模型集中展示了在机器人具身领域的机器基座成果,在亮出人形机器人工厂成绩单、人训开源发布具身生成模型Xiaomi-Robotics-U0过后,练组具身基座模型Xiaomi-Robotics-1也宣告正式发布。合拳
Xiaomi-Robotics-1是小米小米首个基于10万小时真实世界数据进行预训练的机器人策略模型,经过“大规模UMI数据预训练+跨本体机器人数据后训练”的发布两阶段范式后,Xiaomi-Robotics-1可在未见环境、模型未见物体条件下,机器基座直接根据自然语言指令完成鞋柜收纳、桌面整理等移动操作任务,真机测试显示,该模型在四项复杂任务中平均成功率大幅超越行业标杆模型π0.5。
在国际权威评测基准RoboDojo上,Xiaomi-Robotics-1 以 20.07 的平均分数和 13.93% 的平均成功率强势登顶 Leaderboard,实现“断档式”领跑,大幅刷新了此前由行业最优方法保持的纪录(13.07分 / 8.80%成功率)。 在更具挑战性的评测基准RoboCasa上,该模型以57.4%的平均成功率同样位列全球第一。


能力跃升的背后,是规模化训练带来的确定性收益。在预训练阶段,小米具身智能团队观测到该模型会随着预训练数据量和模型规模持续提升,任务成功率呈现清晰的Scaling趋势,验证了机器人策略模型同样存在可预测的规模化收益。
10万小时真实数据打底,首次系统性验证具身智能Scaling Law
小米官方透露,Xiaomi-Robotics-1 的开发初衷之一,是希望验证一个具身智能领域长期悬而未决的问题:如果机器人策略模型能获得足够大规模、足够多样化的真实世界操作数据,它是否也能像大模型一样进入Scaling Law时代?
所谓Scaling Law,可以理解为,“只要持续增加训练数据、扩大模型参数规模,AI 的能力就会呈现可预测的稳定提升,不会轻易碰到天花板”。ChatGPT 这类大语言模型的爆发,本质上就是这条规律的胜利。
但不同于大语言模型可以通过互联网获得近乎免费的数据,具身智能的数据采集严重依赖具体硬件、真实环境和人工遥操,成本巨大且规模有限,天然限制了验证机器人Scaling Law的路径。
为解决这一问题,小米开创了“10万小时无本体UMI数据+规模化自动标注流程”的预训练模式。
拆开来看,“无本体UMI数据”,即不依赖机器人本体采集的数据,这从根本上破解了数据采集昂贵的问题,为10万小时真实操作数据的积累奠定基础;而在面对如此规模的海量数据,传统人工标注的方式难以实现高效处理,为此小米又设计了可规模化的自动标注流程,在不到2周的时间里,完成了全量10万小时数据的高质量标注。

多达10万小时真实世界数据叠加高质量标注,让Xiaomi-Robotics-1在数据规模实验中,“坐实”了具身智能领域的Scaling Law。
实验结果显示,无论是增加数据量还是扩大模型参数,模型的动作预测精度都会稳定提升:当UMI数据量从2500小时逐步增加到20000小时,模型在验证集上的动作预测损失持续降低;当模型参数从2B逐步提升至10B,动作预测能力持续改善。

这说明,对于机器人策略模型而言,扩大真实世界操作数据和模型容量,能够带来可观测的性能收益。更重要的是,这一收益并不只体现在离线指标上。后续真实机器人实验表明,预训练阶段更强的模型,在完成后训练的真实任务执行中也表现更好。
实现“开箱即用”,可通过少量数据适配复杂新任务
进入后训练阶段,小米具身智能团队又为该模型设计“双对齐”的后训练策略。
首先是本体对齐,将预训练阶段从 UMI 数据中获得的动作生成能力,迁移到真实机器人本体上。其次是指令对齐,
将“根据状态变化描述生成动作”的能力,转化为“根据人类自然语言指令执行任务”的能力。
为此,团队构建了约 10000 小时跨本体后训练数据,其中包括 7200+ 小时移动操作机器人和双臂机器人数据、1000+ 小时人工标注 UMI 数据,以及 Bridge V2、RT-1、DROID 等公开机器人数据集。

最终呈现出来的Xiaomi-Robotics-1,展现出了“开箱即用”的能力,也就是在真实环境中,可根据自然语言指令直接执行多类移动操作任务。
需要说明的是,作为一个基座模型,Xiaomi-Robotics-1提供的是"通用能力起点",但不是只会做固定几件事。当遇到复杂的新任务时,不需要从零采集几百小时数据重新训练,而是使用少量下游数据微调就能快速上手。真机测试中,在每个任务平均数据时长不足10小时的条件下,Xiaomi-Robotics-1 在四个任务中均大幅超越行业标杆模型π0.5,说明这种“先训练通用基座,再用少量数据适配任务”的方式,相比于传统方法效率明显更优。对于企业和开发者来说,这也意味着新任务的开发成本和周期都将显著降低。

总的来说,除了验证具身智能Scaling Law,Xiaomi-Robotics-1更大的意义在于,明确了一条面向具身智能的可规模化训练路径:通过大规模预训练,学习通用动作生成表征;再通过跨本体机器人数据后训练,将能力迁移到真实机器人执行;最后通过少量下游数据微调,快速适配复杂新任务。
从仿真测试与真机测试的结果来看,这一路径充分表明,机器人策略模型有机会从过去依赖小规模、任务定制数据的训练方式,走向更接近基座模型的训练范式。
而如果回顾小米过去三天的动作,就会发现小米在具身智能领域的布局,也远不止是训练出一个好用的基座模型那么简单。从前天的机器人在汽车工厂的新进展,到昨天的统一生成模型,再到今天的基座模型,小米完成了具身智能"本体—数据—模型"的三层拼图。硬件本体验证了机器人在真实工业场景的落地能力,数据层解决了机器人训练数据稀缺、生成成本高的瓶颈,模型层则确立了可规模化提升的基座范式。
三者串联起来,一条从数据积累到模型进化、再到真机落地的完整闭环已经清晰可见。
(责任编辑:知识)
-
华为昨日正式发布了全新的Pura 90系列,其定价方案一经公布便引发了网友的广泛好评。在当前全球存储芯片价格持续走高的背景下,这一价格策略被广大用户认为极具竞争力。此次Pura 90系列以4699元起
...[详细]
-
北京时间10月26日消息,掘金客场114-121不敌湖人,掘金吃到本赛季首场失利。全场比赛,约基奇17投9中,三分球5投1中,拿到24分11篮板,不过由于本场比赛湖人一直保持着对约基奇不包夹战术,约基
...[详细]
-
天下晨間新聞 道瓊大漲500點,漲勢會繼續?|特斯拉電動皮卡Cybertruck交車,投資人不興奮|天下雜誌
道瓊大漲500點,創今年新高,漲勢會延續到年底嗎?特斯拉電動皮卡Cybertruck交車,投資人不興奮。微軟成為OpenAI董事會觀察員,奧特曼稱對「政變」策畫者沒有恨。反彈稍縱即逝?中國製造業PMI
...[详细]
-
据泉州海关统计,1—4月,泉州进出口总值为591.53亿元,同比增长11.99%。其中,对“一带一路”国家进出口284.97亿元,同比增长13.22%,占外贸总值的
...[详细]
-
导读: 人寿险和意外险的区别,意外险是寿险还是财险?人寿险是什么?意外险是什么?寿险是什么?财险是什么?意外险属于人身保险,不属于财产险,
...[详细]
-
荣耀WIN系列手机将在12月26日正式发布,在新机发布之前,我们也收到了荣耀方面寄来的邀请函,这份邀请函不仅表达了荣耀WIN系列赢麻了的游戏体验,更是曝出了新机的诸多硬核配置规格。荣耀WIN系列手机将
...[详细]
-
北京时间2018年10月25日,NBA常规赛继续进行,金州勇士坐镇主场迎战奇才。库里首节就暴走状态连续飚进三分,奇才进攻也非常出色死死咬住分差,但库里第三节再爆发单节扔进5记三分,勇士一波流领先到近2
...[详细]
-
南农晨读丨广货行天下 我在海外卖广货_南方+_南方plus【今日关注】第二场“代表通道”举行,代表们在关注这些话题1月27日下午,广东省十四届人大五次会议举行第二场“代表通道”。李巍、石正兵、李霖、许
...[详细]
-
北京时间14日凌晨,WTT欧洲大满贯瑞典站女双赛场爆出冷门。世界冠军王曼昱/蒯曼在1/4决赛中不敌中国香港组合杜凯琹/吴咏琳,止步8强。“双曼”组合是去年世乒赛冠军,在去年中国
...[详细]
-
黑白双熊数据虽好效率惨淡 拼防守勇士棋高一着发布时间:2015-06-23 10:30 来源:网络整理 我来说说 我要投稿[摘要]数据 投篮点 实录 调查 评论 北京时间5月16日,NBA季后赛第二轮
...[详细]

《识质存在》销量炸裂!发售两天突破100万 卡普空再添王牌IP
五经系统车队培训管理会在淮安庄严智库召开
厦门眼科中心五缘院区正式开业 为患者打造全国会诊平台
上海太平洋一集团领导前往云南省发改委考察
百年人寿重疾险,百年人寿重疾险怎么样
