前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
具身智能/10.10 · 11:28/4 MIN/编译自 雷锋网/1 阅读

堆数据不等于更智能:IROS解析机器人策略与通信瓶颈

针对具身智能领域盲目崇拜数据规模的现状,学者在IROS大会上指出,海量数据并不等同于高信息量。从无人机滑翔、多机低带宽协同到机械臂策略过拟合,按需采集关键信息与针对性策略修复,远比无差别堆砌数据更有效。

在生成式 AI 浪潮下,机器人研究正在从传统控制范式向端到端学习加速迁移。随之而来的,是一股对数据规模的盲目崇拜——不少人坚信只要数据足够庞大,就能自然通往通用具身智能。然而,在 IEEE/RSJ 智能机器人与系统国际会议(IROS)上,昆士兰大学学者 Jen Jen Chung 结合多年研究指出:并非所有数据都具备同等价值,盲目堆砌冗余数据不仅无法提升性能,甚至会导致系统决策失能。

学者在IROS大会探讨数据与信息的关系

Chung 强调,海量数据并不等同于高信息密度。在通往自主系统的演进过程中,决定智能上限的关键在于数据的质量与信息增益,而非绝对规模。

演讲主题展示

从无人机滑翔看探索的代价

在无人机自主滑翔研究中,固定翼无人机需要像鸟类一样从风场上升气流中汲取能量以延长滞空时间。这一任务的底层逻辑是:飞行时间越长,探索“状态-动作空间”的机会越多。

无人机自主滑翔与探索策略

然而,探索本身具有实体代价。探索未知空间需要消耗无人机有限的能量储备,如果进行盲目、均匀的无差别采样,不仅浪费资源,还可能拖慢学习进程。实验分析表明,当飞行空速超过特定阈值后,无人机将直接穿过气流而无法截留能量,净能量收益归零。当控制策略明确该区域无增益后,继续在此采集更多数据对策略优化毫无帮助。

这一原理同样适用于未知代价场中的路径规划。算法的终极目标是寻找两点间的最优路径,而非完整重构整个地图。只要预判某处的观测不会改变对全局最短路径的判断,该次采样便属冗余。

针对性探索算法与状态空间采样

多机器人通信:数据共享并非零成本

在分布式多机器人系统中,盲目灌入数据往往会带来更严重的后果——网络拥堵与系统瘫痪。真实环境中的无线信道面临严重的带宽瓶颈与高延迟,向所有节点全量广播所有观测数据并不现实。

Chung 团队提出了衡量数据共享价值的核心准则:“这一项信息是否会改变接收方的行为决策?”

多机协同防碰撞中的通信判定机制

以多机协同防碰撞为例,只有当自身对邻近个体的轨迹预测置信度不足时,才触发状态查询与通信。而在协同建图场景中,直接传输详尽轨迹会造成信道过载,团队引入布隆过滤器对遍历状态进行高密度哈希压缩。针对有损压缩产生的误报率,通过对每次通信引入独立“加盐”机制打破关联性,利用贝叶斯推断跨周期融合多源信息,在低带宽占用下依然保证了极高精度的全局地图同步。

布隆过滤器与哈希映射在地图信息压缩中的应用

此外,团队借鉴网络流媒体思想,开发了渐进式多细节层次的流式传输方案。机器人无需等待完整数据包接收完毕即可先行解码、即时决策,在弱网和丢包环境下表现出远超全量同步机制的系统弹性。

流式传输机制支持非完整数据即时决策

流式传输在通信量与建图质量上的对比实验

策略学习的痛点:过拟合而非数据短缺

当前机器人策略学习普遍尝试通过喂入海量多模态数据来“炼”出通用技能。但在复杂的富接触装配任务中,这种范式遭遇了现实瓶颈。

端到端机器人策略学习的主流范式与挑战

在零件装配实验中,机械臂被输入了包含 RGB-D 双模态视觉、末端六维力矩传感器读数以及本体关节状态的全维度数据。然而部署后发现,机械臂仅机械地重复示教轨迹,甚至在料盒空置时仍旧执行插入动作。这说明模型彻底无视了视觉与力觉信号,单纯依据关节本体感觉死记硬背示范动作,产生了严重的过拟合。

富接触装配任务中的示教训练与部署

传统解法通常是追加更多人工示教数据,但 Chung 与澳大利亚联邦科学与工业研究组织的合作成果表明,微小的光照或背景扰动就会引发策略崩溃,盲目扩大标称数据量无法解决泛化问题。

标称环境与微扰漂移环境下的策略性能对比

为此,研究人员转而分析策略模型内部的微观变化,比对在标称场景与扰动漂移场景下策略动作分布的偏移,映射出诱发策略崩溃的动作漂移空间分布。随后,团队针对性反向检索能够覆盖特征盲区的特定场景样本进行“策略修复”。

动作输出分布漂移与特征空间映射分析

实验表明,在完全相同的示教数据预算下,定向选取修复性样本比单纯扩增数据规模带来的泛化性能提升要显著得多。

策略修复方法与常规扩增的数据预算表现对比

机器人智能体的进化,不应演变为单纯比拼数据吞吐的数字竞赛。无论是无人机、多智能体协同,还是端到端控制模型,唯有聚焦高信息密度的核心样本与决策相关度,才能真正构建起兼具鲁棒性与泛化能力的自主系统。

标签:具身智能过拟合

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

谷歌Playground的账本:做游戏的人付钱,玩游戏的人免费
置顶

谷歌Playground的账本:做游戏的人付钱,玩游戏的人免费

微软和Meta收紧Claude:被削掉的是入口,不是模型
置顶

微软和Meta收紧Claude:被削掉的是入口,不是模型

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
FBTriton 重构 TBE:推荐系统嵌入算子的 Triton 内核设计与性能优化
置顶

FBTriton 重构 TBE:推荐系统嵌入算子的 Triton 内核设计与性能优化

//

24小时热榜

特斯拉FSD欧洲更名为辅助驾驶,德国表态支持准入
TOP1

特斯拉FSD欧洲更名为辅助驾驶,德国表态支持准入

比亚迪第15万台新能源商用车下线,加速布局重卡市场
TOP2

比亚迪第15万台新能源商用车下线,加速布局重卡市场

3

Anthropic模型误报虚假凶杀案线索

9小时前
Anthropic模型误报虚假凶杀案线索
4

微软发布决策模型 Decision-1:专为智能体打造的超快控制层

9小时前
微软发布决策模型 Decision-1:专为智能体打造的超快控制层
5

2026北京安博会定档11月,首设具身智能展区

10小时前
2026北京安博会定档11月,首设具身智能展区
6

中国一汽落地企业智能体:七大硅基员工上岗汽车制造全流程

11小时前
中国一汽落地企业智能体:七大硅基员工上岗汽车制造全流程
7

硅谷大模型掀价格战:Claude比DeepSeek更便宜

12小时前
硅谷大模型掀价格战:Claude比DeepSeek更便宜
8

获5亿美元融资估值翻倍,脱离Meta的Manus迎独立大考

12小时前
获5亿美元融资估值翻倍,脱离Meta的Manus迎独立大考
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断