设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AI成为数学家得力助手还要多久

发布时间: 来源: 新华网

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

解决重大难题仍力不从心zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

需攻克“超长推理链”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

真正的创新和突破仍属人类zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

解决重大难题仍力不从心zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

需攻克“超长推理链”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

真正的创新和突破仍属人类zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。zaR速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

3月17日,记者从陆军军医大学西南医院获悉,该院消化内科教授陈磊团队联合陆军军医大学教授张定林首次提出,活性氧响应性纳米材料能够把程序性死亡配体-1蛋白精准传递到肠道炎症部位,有效缓解肠炎 记者19日从西北大学获悉,该校地质学系、大陆动力学国家重点实验室刘鹏副教授与中国地质大学(北京)李国武教授团队申请的两种新矿物,近日经国际矿物学学会新矿物命名与分类专业委员会审查、投票,均 南方财经全媒体记者马嘉璐 研究员仇雯 广州报道凭借一纸证书,就能获批100万、500万、甚至千万元贷款……数据要素链接金融市场开辟的新财路,正吸引着越来越多的入局者。南方财经全媒 21世纪经济报道记者王峰北京报道 近日,全球教育集团培生(NYSE:PSO)公布2023财年财报。2023财年,培生的销售额为36.74亿英镑(下同),同比下降4%,但基础销售额同比增长1%;调整后营业利润5.73亿,同 美国加州理工学院喷气推进实验室的一个机器人专家团队,与卡内基梅隆大学机器人研究所科学家合作,开发出一种蛇形机器人,用于调查土星第六大卫星土卫二的地形,以寻找生命的“蛛丝马迹”。相关研究 近日有消息称,huaweiMate60已经停产。作为huawei于2023年8月末发布的最新旗舰机型,huaweiMate60的停产意味着huawei新款旗舰或即将上市,接替Mate60。2023年8月29日,huaweiMate60 Pro、huaweiMate60等 。

本文链接:AI成为数学家得力助手还要多久http://www.sushuapos.com/show-2-12732-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 算法“破茧”非一日之功

下一篇: 量子计算机能秒解密码吗

热门资讯

  • “桃花癫”是种病,得治

    民俗有言:桃花开,痴子忙。昨日,一大学生患“桃花癫”登上微博热搜,引发热议。该大学生认为周围女生都喜欢自己,并向全校的女生分别告白。不仅如此,由于精

  • 凌晨重磅!英伟达官宣最强AI芯片

    北京时间凌晨4点至6点,英伟达联合创始人兼CEO黄仁勋发表主题演讲《见证AI的变革时刻》,正式拉开了2024年英伟达GTC大会的序幕。黄仁勋宣布,正

  • 负碳复合建材助力减缓全球变暖

    美国太平洋西北国家实验室的科学家设计了一种复合装饰材料,可以储存更多二氧化碳,提供了一种既符合建筑规范,又比标准复合饰面板便宜的“负碳”选择。

  • 迄今最大三维宇宙地图发布

    国际天文学家团队绘制了迄今最大的三维宇宙地图,记录了大约130万个活跃类星体在空间和时间上的位置。它将成为探测类星体、暗物质晕和超大质量黑洞

  • 自主研制!哈工大“天都二号”探月卫星成功发射

    科技日报从哈尔滨工业大学获悉,北京时间2024年3月20日8时31分28秒,“天都一号”“天都二号”通导技术试验星伴随探月工程四期鹊桥二号中继星任务搭乘

  • 国家工程师丨锻造能“听”清眼疾的高精设备

    眼眸深邃似海、璨如星河,中国医学科学院生物医学工程研究所眼科诊疗技术研发团队(以下简称“团队”)正是眼眸“侦探”。该团队不久前被授予“国家卓越

  • 多层人造皮肤18天内长成

    美国和法国的科学家联合团队借助新的3D打印技术,开发出一种多层人造皮肤,只需18天即可长成。这种仿真皮肤可用于提升护肤品测试效率,并催生更好的皮肤

  • AI、死亡与机器人:“数字生命”背后的生意与争议

    21世纪经济报道记者 冯恋阁 王俊 广州、北京报道2013年播出的科幻电视剧《黑镜》第二季中有这样一个故事——女主角玛莎在男友艾什被车祸

  • 曝huaweiMate60已停产!P70蓄势待发:下个月见

    近日有消息称,huaweiMate60已经停产。作为huawei于2023年8月末发布的最新旗舰机型,huaweiMate60的停产意味着huawei新款旗舰或即将上市,接替Mate60。2023

  • 【科技强国有我】让青年科技人才敢坐“冷板凳”

    习近平总书记在中共中央政治局第三次集体学习时强调,要加强科研学风作风建设,引导科技人员摒弃浮夸、祛除浮躁,坐住坐稳“冷板凳”。甘坐“冷板凳”是

  • 首款骁龙8 Gen3折叠屏!vivo X Fold3图赏

    3月23日消息,vivo X Fold3系列将于3月26日正式发布,成为全球首款骁龙8 Gen3折叠屏电话。现在这款新机外观已经解禁,下面为大家带来图赏。vivo X Fold3提供

  • Kimi掀起国产大模型长文本竞赛

    作为月之暗面的创始人,杨植麟常把他的AGI梦想形容为“登月计划”,长文本就是这个伟大计划的第一步。但现在,随着Kimi的爆火出圈,赛道瞬间变得

推荐资讯

  • 创业板指收跌2.31%,光纤概念逆市走强

      中新经纬4月2日电 2日,A股低开低走,创业板指领跌。截至收盘,上证指数跌0.74%,报3919.29点;深证成指跌1.60%,报13486.94点;创业板指跌2.31%,报3172.65点。  Wind截图  盘面上

  • 【阜成门外】中国增长目标变了,发展模式真的变了吗?

      中新经纬4月1日电 (宋亚芬)在2026年《政府工作报告》中,中国结合经济发展实际提出了今年发展的主要预期目标,即“经济增长4.5%-5%,在实际工作中努力争取更好结果”。  不

  • “未取得特斯拉光伏相关订单” 拉普拉斯午后跳水

      中新经纬4月1日电 拉普拉斯午后跳水。  1日午间,拉普拉斯发布澄清公告称,关注到有媒体发布了关于公司“拉普拉斯中标特斯拉光伏项目第二期,订单规模近百亿”的报道。  

  • 外媒:甲骨文将裁员数千人

      中新经纬4月1日电 美国消费者新闻与商业频道(CNBC)当地时间3月31日消息,软件制造商甲骨文告知员工,公司将裁减数千个工作岗位。此前,该公司股价暴跌,原因是其为构建人工智能

  • 三峡能源2025年净利润降近四成

      中新经纬3月31日电 31日盘后,三峡能源公告,2025年营业总收入283.99亿元,同比下降4.43%;归属于上市公司股东的净利润36.69亿元,同比下降39.94%;扣除非经常性损益的净利润31.28

  • 宏昌科技回应投资“张雪机车”:对公司影响较小

      中新经纬3月31日电 31日盘后,宏昌科技发布股票交易异常波动公告。  宏昌科技股票交易价格连续两个交易日(2026年03月30日、2026年03月31日)收盘价格涨幅偏离值累计达到

  • 三大交易所清明节休市安排:4月4日至6日休市

      中新经纬3月31日电 31日,上交所、深交所、北交所发布2026年清明节休市安排公告,4月4日(星期六)至4月6日(星期一)休市。上交所网站截图深交所网站截图北交所网站截图  三大交

  • 证监会原副主席王建军涉嫌受贿案被提起公诉

      中新经纬3月31日电 据最高人民检察院官方微信号,山东检察机关依法对中国证监会原副主席王建军涉嫌受贿案提起公诉。  中国证券监督管理委员会原党委委员、副主席王建军

  • 曼德海峡告急!油价这次能冲上130美元吗?

      中新经纬3月30日电 (宋亚芬)刚刚过去的周末,中东冲突进一步升级,国际油价30日开盘一度大涨超3%。  数据来源:Wind  数据显示,ICE布油盘中最高突破每桶116美元/桶,逼近美

  • “每10股”写成“每股”,交通银行更正分红公告

      中新经纬3月30日电 交通银行“幽默”了股东们一下。  交通银行30日盘后发布公告称,本行于2026年3月27日披露《交通银行股份有限公司2025年度利润分配方案公告》,因校对

  • 中新经纬“探店1天”系列报道入选2025中国正能量网络精品

      中新经纬3月29日电 3月29日,2025中国正能量网络精品揭晓,中国新闻社旗下中新经纬策划推出的“探店1天”系列报道入选2025中国正能量网络精品“网络正能量主题活动”。  

  • 日榜
  • 周榜
  • 月榜