设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AI成为数学家得力助手还要多久

2025-06-18 09:18:44 来源: 新华网

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

解决重大难题仍力不从心IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

需攻克“超长推理链”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

真正的创新和突破仍属人类IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

解决重大难题仍力不从心IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

需攻克“超长推理链”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

真正的创新和突破仍属人类IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。IL7速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

本文链接:AI成为数学家得力助手还要多久http://www.sushuapos.com/show-2-12732-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 算法“破茧”非一日之功

下一篇: 量子计算机能秒解密码吗

热门资讯

  • 云南首批621座变电站实现人工智能巡检

    “远方巡视启动!”南方电网云南保山220千伏大寨变电站日前启动首次全套智能巡视,109个摄像头快速旋转,10套在线监测系统开始收集数据,变电站的无人机机

  • “95后”的无人机“造像师”

    “当时是怎样选中低空经济这个领域,并且来深圳发展的?”面对这个关乎事业发展的问题,“95后”台青张晏纶坦言,“这是一场面试带来的惊喜。”张晏纶来自

  • 借AI“慧眼”鉴别可疑论文图片

    今年1月,英国分子生物学家肖尔托·戴维发表文章,指控美国哈佛大学医学院附属丹娜-法伯癌症研究所科学家通过修改图片伪造数据。随后该研究所正

  • 12类健康食品获电商10亿资源扶持 “吃得健康”酝酿产业机会

    21世纪经济报道记者孔海丽、实习生邓熙涵 北京报道“民以食为天,食与民同欢”,吃得健康、吃得安全是消费者长期以来的普遍共识。当代消费者

  • 突发!Kimi,崩了!

    因流量突然剧增,3月21日,陆续有用户在社交平台上表示,月之暗面旗下大模型应用Kimi智能助手的APP和小程序均无法正常使用。截至记者发稿时,相关

  • 原来,中国空间站里“四季如春”

    春,推也。从草从日,草春时生也。进入春日,人们时常能在大地回暖、万物复苏中见证旺盛的生命力。一起解锁空间站里的“春日关键词”,感受太空中的“春日

  • 地下水位上升 生态用水充足——华北地区地下水超采综合治理成效显著

    “截至2023年底,与2018年同期相比,京津冀治理区浅层地下水位平均回升2.59米,深层承压水水位平均回升7.06米。”3月22日世界水日到来之际,水利部水资源

  • 新研究揭示 光合作用进化“缺失的一环”

    一个国际团队近日在英国《自然》杂志上发表论文说,他们利用湖水样本培养出一种奇特的光合细菌,它属于绿弯菌门一种此前未知的目,代表了光合作用生物进

  • 单个颗粒无标记光学显微成像实现

    记者3月21日从中国科学技术大学获悉,该校物理学院张斗国教授课题组,提出并实现了一种基于矢量光场调控原理的动量空间偏振滤波器件。该滤波器件安装

  • 被美国诉讼垄断:iPhone回应想让苹果变成安卓!iOS开放还怎么玩

    3月22日消息,美国司法部对iPhone提起诉讼,声称其苹果生态系统构成垄断。司法部表示,iPhone将苹果生态系统视为一种垄断,以牺牲消费者、开发者和竞争对手的

  • 吸烟会增加腹部脂肪

    科学杂志《成瘾》3月21日发表的一项新研究显示,刚开始吸烟和终生吸烟都可能增加腹部脂肪,特别是内脏脂肪。内脏脂肪与心脏病、糖尿病、中风和痴呆症

  • “穿上就走”的通用外骨骼面世

    美国佐治亚理工学院机械工程师开发了一种控制机器人外骨骼的通用方法。无需专门训练、特别校准,对复杂算法进行调整后,用户穿上外骨骼就可以直接行走

推荐资讯

  • 全国10月销售彩票同比增6% 26省份销量增长

      中新经纬11月24日电 24日,财政部网站发布2025年10月份全国彩票销售情况。  10月份,全国共销售彩票468.93亿元,同比增加26.68亿元,增长6.0%,主要是去年同期即开型彩票销售基

  • “鸡王”养猪,年入32亿

      中新经纬11月24日电 (闫淑鑫)近日,广东天农集团股份有限公司(下称天农集团)递表港交所。天农集团前身是广东天农食品有限公司,成立于2003年,从养殖清远鸡起家,目前核心产品

  • 熊节:斯诺登警告,OpenAI已卸下伪装……

    【文/观察者网专栏作者 熊节】 2025年5月13日,一家美国联邦法院发出了一项令人震惊的命令。该命令要求OpenAI“保存并隔离所有用户活动记录”,即使用户或企业希望删除这些记

  • 银行国资轮番下场卖房

    二手房市场上出现了不少机构的身影。在阿里资产、京东拍卖等平台上,六大国有银行各地分行、股份制银行分行,以及区域性城商行与农商行纷纷上线卖房;在各大资源转让或拍卖平台

  • 屈臣氏再闯IPO:李嘉诚的零售帝国迎来关键时刻

    (文/霍东阳 编辑/张广凯) 相隔十年多,屈臣氏上市计划终于有了新消息。 据《华尔街日报》引述消息报道,长江和记实业正计划推动旗下屈臣氏集团在香港与英国两地上市,预计最高融

  • 存储非理性“疯狂”:明年手机会更贵了?

    11月20日,在深圳华强北电子世界,主营内存产品经销的杨先生现在的感觉很复杂——就在去年这个时候,他还在发愁怎么处理手里堆积的内存条,甚至动过关店

  • 电子烟频频被“片面研究”拉下水,减害专家呼吁回归科学理性

    在过去十年中,电子烟被证实可以作为卷烟替代品、减少吸烟危害,这是公共卫生领域的一项重要突破,包括英国、新西兰等国家有数百万烟民已完全或部分转向这种更安全的尼古丁产品。

  • 国内十大金价实时行情查询平台大全!

    贵金属已经成为主要的一种投资方式,现货黄金以投资小、收益高的优势吸引了很多投资者,网上有不少现货黄金交易平台可以做现货黄金交易,可以说炒黄金是现在黄金交易中的一个热门

  • 11月25日人民币对美元中间价报7.0826元 上调21个基点

      11月25日人民币对美元中间价报7.0826元 上调21个基点  中新网11月25日电 据中国外汇交易中心网站消息,中国人民银行授权中国外汇交易中心公布,2025年11月25日银行间外汇

  • 中直股份子公司哈飞集团拟吸收合并哈飞航空

      中新经纬11月25日电 中直股份24日晚间公告,哈尔滨飞机工业集团有限责任公司(下称“哈飞集团”)和哈尔滨哈飞航空工业有限责任公司(下称“哈飞航空”)均为公司全资子公司

  • 龙佰集团子公司龙佰襄阳因5死1伤事故被罚

      中新经纬11月24日电 龙佰集团24日晚间公告,公司全资子公司龙佰襄阳钛业有限公司(以下简称“龙佰襄阳”)收到襄阳市应急管理局下发的《行政处罚决定书》。  据《行政

  • *ST创兴被责令改正 董事长刘鹏等遭警示

      中新经纬11月24日电 因财务数据存在虚假记载等违规行为,*ST创兴被责令改正,公司董事长刘鹏等9人遭警示。  *ST创兴11月24日晚间公司,公司于当日收到上海证监局出具的《

  • 日榜
  • 周榜
  • 月榜