盖世汽车讯 机器人正逐渐进入家庭、公共场所、办公室、工厂以及医疗保健等各类场景。然而,尽管机器人具有巨大潜力,许多现有机器人在动态且不可预测的真实环境中的表现,仍不及其在受控实验室环境中的测试效果。
据外媒报道,上海期智研究院的研究人员近日开发出一种名为RL-100的新型人工智能(AI)学习方法,可帮助机器人更快掌握新技能,并在不断变化的环境中稳定完成任务。该团队在发表于期刊《Science Robotics》的一篇论文中介绍了这一框架。RL-100融合了两种AI训练方法——模仿学习(imitation learning)和强化学习(reinforcement learning)。
论文第一作者Kun Lei在接受Tech Xplore采访时表示:“这一项目源于我们反复观察到的一个差距:机器人能够成功演示某项任务,并不意味着它能够在真实世界中稳定可靠地完成这项任务。”
Kun Lei称:“模仿学习通过让机器人学习人类示范,为其提供了良好的起点,但有限的示范数据无法覆盖所有失败情况、外部扰动或意外场景。一个机器人即便10次中成功9次,在实验室里看起来已经相当出色,但对于许多真实世界应用而言,其可靠性仍然不足。”
弥合实验室演示与真实世界应用之间的差距
为了提升机器人在真实动态环境中的表现,Kun Lei及其同事尝试将传统模仿学习策略与强化学习结合起来训练机器人策略。
模仿学习是指向机器人算法输入人类完成任务的视频,使其学习如何执行相应任务。相比之下,强化学习则通过不断试错进行训练,当AI系统采取正确行动时给予奖励,从而不断优化其决策能力。
Kun Lei表示:“我们思考,强化学习是否可以像基础模型的后训练(post-training)一样,作为机器人策略的后训练阶段。我们的核心目标,是弥合从示范到可靠执行之间的‘最后一公里’差距,不仅提升任务成功率,还提高执行速度、鲁棒性以及从错误中恢复的能力。”
研究团队提出的RL-100学习框架主要包括三个阶段。
郑重声明:此文内容为本网站转载企业宣传资讯,目的在于传播更多信息,与本站立场无关。仅供读者参考,并请自行核实相关内容。
-
液化天然气槽罐车遭货车追尾发生泄漏多部门福建省南平市消防救援支队13日透露,12日14时左右,该支队指挥中心接到报警,称... -
180人星夜驰援!7小时筑起6公里“防疫180人星夜驰援!7小时筑起6公里“防疫长城”题:180人星夜驰援!7小时筑起6... -
疫情下7人管好5000人“居委干部不要怕疫情下7人管好5000人“居委干部不要怕认错”题:疫情下7人管好5000人“居委...
-
上海期智研究院研发RL?100学习框架提升机器人抗环
2026-08-07 14:08
-
至境L7纯电版国补后预售价16.99起续航702公里
2026-08-07 05:17
-
818狂欢季启幕购车即享终身质保零跑8月全系购车权益
2026-08-07 02:14
-
星光L上市两周累计交付5650台领跑10万级大六座市
2026-08-06 18:50
-
L4商业化提速背后:车载光学供应链的隐形“卡位战”
2026-08-06 14:54
-
Seeds?给富士康供货的减速器厂商,刚融了超亿元
2026-08-06 08:08
-
韩国研究团队开发出混合动力电池粘合剂可提高电动汽车的
2026-08-06 00:45
-
魏牌CEO赵永坡澄清蓝山停产传闻:未停产,计划Q4推
2026-08-05 19:31
-
超时一分钟多收一小时?停车收费岂能“向上取整”
2026-08-05 10:56
-
推3款车型极氪9X五座版上市限时价45.19-56.
2026-08-05 01:08
-
日产汽车二季度实现扭亏为盈
2026-08-04 21:00
-
韩国与阿根廷签署关键矿产合作谅解备忘录
2026-08-04 15:28
-
惠民生促消费中国银联携手多地文旅单位开启夏日惠民季
2026-08-04 14:55
-
传奇色彩美孚1号?倾情助阵保时捷驾驶中心全国路演
2026-08-04 12:48
-
神州租车合肥分公司携手中国石油安徽公司,升级暑期自驾
2026-08-04 06:31



















