设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

我国科学家提出高效推理策略 可避免大模型“过度思考”

发布时间: 来源: 新华网

随着人工智能大模型的不断发展,如何让其在“难”的问题上深入思考,而不是对所有问题“想个不停”?记者5月29日从中国科学院自动化研究所获悉,该所联合鹏城实验室提出了一种高效推理策略AutoThink,可让大模型实现自主切换思考模式,避免“过度思考”。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“当前,越来越多的大模型开始具备‘深度思考能力’。”中国科学院自动化研究所研究员张启超说,模型在回答问题之前要先生成一整段包含反复自我反思、自我验证的推理过程,然后再给出答案。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

张启超表示,这一思考模式显著提升了大模型解决复杂问题的能力,但同时也带来了“过度思考”的问题,即在处理简单任务时也会生成冗余的思考过程。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“比如使用者对大模型提问‘2+3等于几’,大模型可能会从自然数定义讲起,列出加法交换律,甚至反复确认,最后才输出答案是5。”张启超说,这种不必要的“过度思考”现象在推理模型中广泛存在。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

针对这一问题,AutoThink可赋予推理模型根据题目难度自主切换思考模式的能力,即通过所设计的提示词和多阶段强化学习,引导其自主决定是否进行深度思考。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

张启超介绍,AutoThink提供了一种简单而有效的推理新范式——通过省略号提示配合三阶段强化学习,引导大模型不再“逢题必深思熟虑”,而是根据问题难度自主决定“是否思考”“思考多少”。在多个数学数据集上,AutoThink实现了准确率与效率平衡,既提升性能又节省算力,展示出较强的适应性和实用性。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据悉,AutoThink已集成于一站式智能科研平台ScienceOne,并将用于训练ScienceOne的基座大模型S1-Base。研发团队表示,让大模型“更聪明地思考、更简洁地表达”,是未来科学基础大模型演进的重要方向。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

随着人工智能大模型的不断发展,如何让其在“难”的问题上深入思考,而不是对所有问题“想个不停”?记者5月29日从中国科学院自动化研究所获悉,该所联合鹏城实验室提出了一种高效推理策略AutoThink,可让大模型实现自主切换思考模式,避免“过度思考”。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“当前,越来越多的大模型开始具备‘深度思考能力’。”中国科学院自动化研究所研究员张启超说,模型在回答问题之前要先生成一整段包含反复自我反思、自我验证的推理过程,然后再给出答案。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

张启超表示,这一思考模式显著提升了大模型解决复杂问题的能力,但同时也带来了“过度思考”的问题,即在处理简单任务时也会生成冗余的思考过程。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

“比如使用者对大模型提问‘2+3等于几’,大模型可能会从自然数定义讲起,列出加法交换律,甚至反复确认,最后才输出答案是5。”张启超说,这种不必要的“过度思考”现象在推理模型中广泛存在。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

针对这一问题,AutoThink可赋予推理模型根据题目难度自主切换思考模式的能力,即通过所设计的提示词和多阶段强化学习,引导其自主决定是否进行深度思考。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

张启超介绍,AutoThink提供了一种简单而有效的推理新范式——通过省略号提示配合三阶段强化学习,引导大模型不再“逢题必深思熟虑”,而是根据问题难度自主决定“是否思考”“思考多少”。在多个数学数据集上,AutoThink实现了准确率与效率平衡,既提升性能又节省算力,展示出较强的适应性和实用性。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据悉,AutoThink已集成于一站式智能科研平台ScienceOne,并将用于训练ScienceOne的基座大模型S1-Base。研发团队表示,让大模型“更聪明地思考、更简洁地表达”,是未来科学基础大模型演进的重要方向。zQo速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

在今天的故宫,工作人员使用的数字化办公平台名叫“内务辅”,这款应用的开发者,是与故宫博物院合作的钉钉(中国)信息技术有限公司(以下简称“钉钉”)。3月18日,故宫博物院与钉钉战略合作签约仪式在故 近日,国家知识产权局等五部门联合印发了《专利产业化促进中小企业成长计划实施方案》(以下简称《实施方案》)。《实施方案》提出,到2025年底,中小企业知识产权意识和专利转化运用能力得到普遍提升   239万的无人驾驶航空器淘宝上架,人人可以“打飞的”还有多远  239万元/架的无人驾驶载人航空器也看上了电商渠道。  3月18日,亿航智能设备(广州)有限公司(下称“亿航智能”)在淘宝上架了其生产的EH216-S无人驾   英伟达AI风暴席卷医疗行业 “AI制药”是风口还是泡沫?  季媛媛  全球医疗健康行业正刮起最强AI风暴。  当地时间3月18日,全球瞩目的顶级AI盛会――英伟达2024年GPU技术大会(NVIDIA GTC 2024)正式开幕。据相关 英伟达的GPU又升级了。3月19日,英伟达CEO黄仁勋发布了最新的B200算力芯片GPU,FP8精度下的训练性能是上一代的2.5倍,FP4精度下的推理性能更是达到了上一代的5倍。然而,这场技术狂欢背后,却令AI领域 3月23日20时30分许,内蒙古自治区鄂尔多斯市,约200米的高楼、磐石造型博物馆、书籍外形图书馆等主要地标建筑纷纷关闭灯光,人们在静下来的城市里感受地球的呼吸与脉动。今年“地球一小时”中国 。

本文链接:我国科学家提出高效推理策略 可避免大模型“过度思考”http://www.sushuapos.com/show-2-12513-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: “老将”立“新功” 天问二号“专属座驾”有这些看点

下一篇: 中国邀请上合组织成员国共建人工智能应用合作中心

热门资讯

推荐资讯

  • 日榜
  • 周榜
  • 月榜