设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

机器人“大脑”“身体”双线突破,为何仍难大规模落地?中国信通院详解

发布时间: 2025-12-17 10:20:36 来源: 人民网

12月13日,在“2026中国信通院深度观察报告会”上,中国信通院副总工程师许志远表示,当前具身智能已取得认知智能与物理智能的双线突破,但模型路线、数据范式以及最佳机器人形态仍未定型,大规模落地仍处于早期阶段,其未来方向仍在持续竞争与快速演化中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

具身智能取得阶段性突破0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仍需关注三大核心争论0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远介绍,当前具身智能发展已取得阶段性突破。一方面,机器人的“认知智能”(即“大脑”能力)实现明显跃升。大模型使机器人能够完成传统机器人难以处理的复杂任务,具备“可感知、可思考、可交互”的智能特征。另一方面,“物理智能”加速突破。基于强化学习,人形机器人在复杂地形行走、高难度舞蹈等动态任务上表现显著提升;基于模仿学习与大模型范式,上肢操作能力快速增强,已能执行切黄瓜、倒水、叠衣服等精细操作。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“尽管技术突破不断,但具身智能的大规模落地仍处于早期阶段。”许志远指出,当前行业主要存在三方面争论。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

一是模型路线之争,大模型范式是否适用于机器人?虽然大模型在语言、图像、视频领域取得巨大成功,但“同样的范式能否直接迁移到机器人控制”仍未被证明。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

二是数据训练范式之争,哪类数据才是机器人智能提升的关键?数据仍然是限制机器人能力跃升的核心瓶颈。目前机器人模型主要依赖三类数据:真机数据质量最高但采集昂贵、规模有限;合成/仿真数据规模大、成本低,但逼真度与物理一致性有差距;人类第一视角视频数据自然、丰富,但动作标注与映射存在挑战。当前尚无结论表明机器人是否一定会因为有更多的数据而产生更强的能力。因此,数据范式仍在快速演化,混合数据、多模态数据、世界模型生成数据等方向均在探索中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

三是形态路线之争,人形机器人是否是“真需求”?具身智能的落地呈现出两大派系:一类是“人形坚守派”。这些企业坚持全人形路线,认为人形最契合人类社会现有环境与工具体系,人形形态最利于学习人类动作、利用人类数据,并且长期看具备最大通用性。另一类是折中派。我国今年涌现出多款“轮-臂式复合机器人”,其特点是轮式底盘更可靠、成本更低、部署更简单;动作可控性强,更适合集成到商业场景快速落地。此路径更强调“工程可落地性”,旨在在短期内形成可规模化的商业应用。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

进一步引入世界模型0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

有望提升机器人大模型能力0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据许志远介绍,目前,利用大模型提升机器人的泛化能力已成为业界共识,但如何有效地将大模型应用于机器人系统,仍存在多条技术路径,行业也在持续探索中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

第一条路径是采用大语言模型(LLM)对人类指令进行语义理解与任务分解,这是赋予机器人高层智能的关键能力。第二条路径是在LLM的基础上引入视觉,使模型具备语言与视觉跨模态融合能力,通过视觉语言模型(VLM)进行机器人控制。借助视觉信息,模型不仅能分析环境的空间关系和物体属性,也能更好支撑高层任务规划。第三条路径是在VLM的基础上进一步加入动作生成能力,形成视觉—语言—动作模型(VLA)。这类模型以视觉图像和语言指令为输入,直接输出机器人控制指令。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远表示,视觉—语言—动作模型路线自2024年底以来受到高度关注。各家厂商在模型架构、模块设计和动作生成方式上不断优化。“然而尽管VLA在结构上不断演进,其实际落地效果仍未达到预期。原因在于物理世界具有高度多样性与不确定性,而当前可获取的机器人数据量级有限、覆盖场景不足。”0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远指出,展望未来,在视觉—语言—动作模型的基础上引入世界模型(World Model),借助其对物理世界的理解、预测与推演能力,有望成为进一步提升机器人大模型能力的重要发展路径。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

合成数据和视频数据更受重视0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

满足机器人模型训练需求0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远指出,机器人的真机数据虽然质量最高,但人工采集的成本极高,高质量样本更是稀缺,远远无法满足模型的训练需求。因此,业界开始越来越重视合成数据和视频数据的利用。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

具体来看,一方面,业界开始采用混合数据训练模式,先利用合成数据或视频数据进行模型预训练,再用真机数据进行微调。例如,银河通用使用10亿帧合成数据完成抓取模型的预训练;英伟达GROOT N1模型中,合成、视频和真机数据分别占25%、31%和44%。“我们发现,主流方案的非真机数据占比通常在80%—99%,但是哪个比例对于机器人性能提升更加有效仍需产业界来不断试错验证。”许志远表示。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

另一方面,今年以来,使用人类第一视角拍摄的视频数据成为破解数据瓶颈的一类重要方案。让操作员佩戴头戴式摄像设备,在不影响日常工作的前提下记录其操作过程,为模型训练提供高质量的人类示范数据。许志远表示,目前国内外多家企业已发布相关项目或进行路线探索。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

12月13日,在“2026中国信通院深度观察报告会”上,中国信通院副总工程师许志远表示,当前具身智能已取得认知智能与物理智能的双线突破,但模型路线、数据范式以及最佳机器人形态仍未定型,大规模落地仍处于早期阶段,其未来方向仍在持续竞争与快速演化中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

具身智能取得阶段性突破0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仍需关注三大核心争论0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远介绍,当前具身智能发展已取得阶段性突破。一方面,机器人的“认知智能”(即“大脑”能力)实现明显跃升。大模型使机器人能够完成传统机器人难以处理的复杂任务,具备“可感知、可思考、可交互”的智能特征。另一方面,“物理智能”加速突破。基于强化学习,人形机器人在复杂地形行走、高难度舞蹈等动态任务上表现显著提升;基于模仿学习与大模型范式,上肢操作能力快速增强,已能执行切黄瓜、倒水、叠衣服等精细操作。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“尽管技术突破不断,但具身智能的大规模落地仍处于早期阶段。”许志远指出,当前行业主要存在三方面争论。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

一是模型路线之争,大模型范式是否适用于机器人?虽然大模型在语言、图像、视频领域取得巨大成功,但“同样的范式能否直接迁移到机器人控制”仍未被证明。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

二是数据训练范式之争,哪类数据才是机器人智能提升的关键?数据仍然是限制机器人能力跃升的核心瓶颈。目前机器人模型主要依赖三类数据:真机数据质量最高但采集昂贵、规模有限;合成/仿真数据规模大、成本低,但逼真度与物理一致性有差距;人类第一视角视频数据自然、丰富,但动作标注与映射存在挑战。当前尚无结论表明机器人是否一定会因为有更多的数据而产生更强的能力。因此,数据范式仍在快速演化,混合数据、多模态数据、世界模型生成数据等方向均在探索中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

三是形态路线之争,人形机器人是否是“真需求”?具身智能的落地呈现出两大派系:一类是“人形坚守派”。这些企业坚持全人形路线,认为人形最契合人类社会现有环境与工具体系,人形形态最利于学习人类动作、利用人类数据,并且长期看具备最大通用性。另一类是折中派。我国今年涌现出多款“轮-臂式复合机器人”,其特点是轮式底盘更可靠、成本更低、部署更简单;动作可控性强,更适合集成到商业场景快速落地。此路径更强调“工程可落地性”,旨在在短期内形成可规模化的商业应用。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

进一步引入世界模型0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

有望提升机器人大模型能力0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据许志远介绍,目前,利用大模型提升机器人的泛化能力已成为业界共识,但如何有效地将大模型应用于机器人系统,仍存在多条技术路径,行业也在持续探索中。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

第一条路径是采用大语言模型(LLM)对人类指令进行语义理解与任务分解,这是赋予机器人高层智能的关键能力。第二条路径是在LLM的基础上引入视觉,使模型具备语言与视觉跨模态融合能力,通过视觉语言模型(VLM)进行机器人控制。借助视觉信息,模型不仅能分析环境的空间关系和物体属性,也能更好支撑高层任务规划。第三条路径是在VLM的基础上进一步加入动作生成能力,形成视觉—语言—动作模型(VLA)。这类模型以视觉图像和语言指令为输入,直接输出机器人控制指令。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远表示,视觉—语言—动作模型路线自2024年底以来受到高度关注。各家厂商在模型架构、模块设计和动作生成方式上不断优化。“然而尽管VLA在结构上不断演进,其实际落地效果仍未达到预期。原因在于物理世界具有高度多样性与不确定性,而当前可获取的机器人数据量级有限、覆盖场景不足。”0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远指出,展望未来,在视觉—语言—动作模型的基础上引入世界模型(World Model),借助其对物理世界的理解、预测与推演能力,有望成为进一步提升机器人大模型能力的重要发展路径。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

合成数据和视频数据更受重视0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

满足机器人模型训练需求0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

许志远指出,机器人的真机数据虽然质量最高,但人工采集的成本极高,高质量样本更是稀缺,远远无法满足模型的训练需求。因此,业界开始越来越重视合成数据和视频数据的利用。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

具体来看,一方面,业界开始采用混合数据训练模式,先利用合成数据或视频数据进行模型预训练,再用真机数据进行微调。例如,银河通用使用10亿帧合成数据完成抓取模型的预训练;英伟达GROOT N1模型中,合成、视频和真机数据分别占25%、31%和44%。“我们发现,主流方案的非真机数据占比通常在80%—99%,但是哪个比例对于机器人性能提升更加有效仍需产业界来不断试错验证。”许志远表示。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

另一方面,今年以来,使用人类第一视角拍摄的视频数据成为破解数据瓶颈的一类重要方案。让操作员佩戴头戴式摄像设备,在不影响日常工作的前提下记录其操作过程,为模型训练提供高质量的人类示范数据。许志远表示,目前国内外多家企业已发布相关项目或进行路线探索。0J8速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  监管AI,欧盟出手,美国掉队?  上个世纪,科幻小说家艾萨克・阿西莫夫提出了“机器人三定律”,带来了对“机器人”与“规则”的美好幻想。  如今,伴随着ChatGPT、Sora的爆火,人工智能(AI)领域的激烈竞争,对该领域的监管 3月20日8时31分,探月工程四期鹊桥二号中继星由长征八号遥三运载火箭在中国文昌航天发射场成功发射升空。火箭飞行24分钟后,星箭分离,将鹊桥二号中继星直接送入近地点高度200公里、远地点高度42 记者3月21日获悉,商汤科技与遥感数据平台吉林一号网、四维地球、星图地球等展开合作,此举标志着“SenseEarth智能遥感云”平台数据源全面升级,将为行业用户提供更完善、精准的一体化的高分辨率 3月21日是第二十五个“世界睡眠日”,中国睡眠研究会联合慕思集团在北京正式发布《2024情绪与健康睡眠白皮书》(以下简称《白皮书》)。《白皮书》指出,智能床垫运用算法将内在情绪与睡眠质量相关 近日有消息称,huaweiMate60已经停产。作为huawei于2023年8月末发布的最新旗舰机型,huaweiMate60的停产意味着huawei新款旗舰或即将上市,接替Mate60。2023年8月29日,huaweiMate60 Pro、huaweiMate60等 3月24日消息,据媒体报道,huawei电话供应链公司,已开始向huaweiP70系列高端旗舰电话批量供货。同时有产业链人士透露,huawei给出的P70系列出货目标指引相对乐观。据数码博主“数码闲聊站”爆料,huaweiP 。

本文链接:机器人“大脑”“身体”双线突破,为何仍难大规模落地?中国信通院详解http://www.sushuapos.com/show-2-14546-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 便捷与安全,谁的优先级?豆包手机助手放弃银行App引责任之辩

下一篇: 视频丨我国新型无人机成功首飞

热门资讯

推荐资讯

  • 科普六大攻略:便荔卡15000怎么套取?

    羊小咩APP不少人都有,伴随着生活节奏的加快,以及生活压力的加重,不少人会拿羊小咩便荔卡额度来变现应急。 那么,羊小咩便荔卡怎么套出来的,羊小咩便荔卡额度怎么套出来使用?

  • 揭晓必看-羊小咩便荔卡10000怎么套取?

    值得一提的是,羊小咩还将社交、生活、文化等多元内容充分融合,在优质的生活服务上搭配娱乐化、 趣味化的体验玩法,并将进一步夯实“数字生活”特色,将服务内容延展到生活缴

  • 科普三种方法:羊小咩购物额度怎么套出来!

    值得一提的是,羊小咩还将社交、生活、文化等多元内容充分融合,在优质的生活服务上搭配娱乐化、 趣味化的体验玩法,并将进一步夯实“数字生活”特色,将服务内容延展到生活缴

  • 小二分享真实秒到方法-羊小咩便荔卡怎么套取微信?

    羊小咩紧跟“数字消费”的潮流,将社交、生活、文化等元素深度融合,在提供优质生活服务的同时,注入娱乐化、趣味化的体验元素。它致力于巩固“数字生活”的特色,将服务内容扩展至

  • 介绍简单秒到技巧-羊小咩便荔卡怎么套取微信?

    羊小咩作为一款新兴的消费支付产品,为广大用户提供了便捷的购物体验。然而,有些用户在使用过程中,希望能将自己的羊小咩额度套出来使用。以下将为您推荐几种羊小咩额度套取的方

  • 整理4个攻略羊小咩便利卡简单套出的方法!

    羊小咩作为一款新兴的消费支付产品,为广大用户提供了便捷的购物体验。然而,有些用户在使用过程中,希望能将自己的羊小咩额度套出来使用。以下将为您推荐几种羊小咩额度套取的方

  • 享有:便荔卡秒到账攻略!

    羊小咩紧跟“数字消费”的潮流,将社交、生活、文化等元素深度融合,在提供优质生活服务的同时,注入娱乐化、趣味化的体验元素。它致力于巩固“数字生活”的特色,将服务内容扩展至

  • 今日必看方法-便荔卡秒到账商家!

    羊小咩把消费、娱乐、购物、生活、产品、服务、平台、技术全部融合到一起,打造出创新的智能化消费服务平台,服务准确、多元、贴心,这就是羊小咩智能化消费服务平台的特色。 年

  • 小二分享安全秒到攻略-羊小咩秒到账攻略!

    羊小咩把消费、娱乐、购物、生活、产品、服务、平台、技术全部融合到一起,打造出创新的智能化消费服务平台,服务准确、多元、贴心,这就是羊小咩智能化消费服务平台的特色。 年

  • 独学:羊小咩便利卡怎么取出秒到!

    企业面临着不断创新和改进的压力,以满足这些变化中的消费者需求。大数据、人工智能等先进技术的运用,如通过分析消费者的购买行为、偏好和反馈,成为开发更贴合市场需求产品和服

  • 小二分享真实秒到攻略-羊小咩秒到账技巧!

    羊小咩把消费、娱乐、购物、生活、产品、服务、平台、技术全部融合到一起,打造出创新的智能化消费服务平台,服务准确、多元、贴心,这就是羊小咩智能化消费服务平台的特色。 年

  • 2026新手必须:羊小咩便荔卡靠谱套取秒到商家!

    在数字化时代,智能手机已成为我们生活中不可或缺的一部分。羊小咩商城作为一个新兴的电商平台,提供了丰富的数码手机选择, 但消费者在购买时往往会对其真伪产生疑问。本文将为

  • 日榜
  • 周榜
  • 月榜