设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

京产大模型成果登上国际顶级期刊

发布时间: 2026-01-30 09:33:52 来源: 北京日报

当地时间1月28日,北京智源人工智能研究院的一项突破性研究成果在国际顶级学术期刊《自然》(Nature)上线,这是我国科研机构主导的大模型成果首次在《自然》正刊发表。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

2018年以来,GPT采用“预测下一个词元(Next-token prediction,NTP)”的自回归路线,实现了语言大模型重大突破,开启了生成式人工智能浪潮。而擅长同时处理文字、图片、视频等多种形态信息的多模态模型主要依赖对比学习、扩散模型等专门路线。在此背景下,一个重要问题困扰行业数年:能否用一种简单、统一的方法即自回归路线,让AI(人工智能)同时学会高效地处理文字、图片和视频?XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

智源这项名为“通过预测下一个词元进行多模态学习的多模态大模型”的成果给出了肯定的答案。该成果表明,只采用自回归路线,就可以统一多模态学习,训练出优秀的原生多模态大模型,这对于确立自回归成为生成式人工智能统一路线具有重大意义。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

记者了解到,长期以来,AI在学习不同类型的“感官”信息时,往往需要“分科而治”——理解文字用一套方法,生成图片用另一套,处理视频又需要不同的专业模型,过程复杂且协同起来较为困难。而智源研究院研发的Emu3模型,借鉴了GPT成功的关键思路“预测下一个词元”,成功统一了对文本、图像及视频的理解与生成能力。打个比方,就如同给AI找到了一个“万能学习法”,无论面对的是一段文字、一张照片,还是一段动态影像,AI都用同一种逻辑去分析和创造。实验表明,这种统一方法在图片生成、图文理解和视频创作等多个任务上,达到了与当前各类专用模型相当的水平,且具备更强的扩展潜力和通用性。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

《自然》编辑点评这项研究时表示,基于“预测下一个词元”,Emu3实现了大规模文本、图像和视频的统一学习,其在生成与感知任务上的性能可与使用专门路线相当,这一成果对构建可扩展、统一的多模态智能系统具有重要意义。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

值得一提的是,基于这一核心路径的迭代版本Emu3.5模型,已展现出对物理世界运行规律的初步学习与模拟能力,能够尝试预测场景的下一步变化,为发展更通用、更接近人类认知方式的大模型与智能体奠定了基础。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据悉,自2020年启动“悟道”大模型研究以来,智源研究院持续聚焦大模型的原始创新与长期技术路径探索。2025年6月,智源发布新一代大模型系列成果“悟界”,目标是构建人工智能从数字世界迈向物理世界的关键能力,打造物理世界的人工智能基座模型。该系列模型包括:Emu系列多模态世界模型、RoboBrain跨本体具身大脑、数字孪生心脏、Brainμ脑科学多模态基础模型以及OpenComplex全原子生命模型等,共同构建起覆盖宏观具身智能、介于宏观和微观尺度的生命系统到微观构象动力学的多层次技术基座。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

当地时间1月28日,北京智源人工智能研究院的一项突破性研究成果在国际顶级学术期刊《自然》(Nature)上线,这是我国科研机构主导的大模型成果首次在《自然》正刊发表。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

2018年以来,GPT采用“预测下一个词元(Next-token prediction,NTP)”的自回归路线,实现了语言大模型重大突破,开启了生成式人工智能浪潮。而擅长同时处理文字、图片、视频等多种形态信息的多模态模型主要依赖对比学习、扩散模型等专门路线。在此背景下,一个重要问题困扰行业数年:能否用一种简单、统一的方法即自回归路线,让AI(人工智能)同时学会高效地处理文字、图片和视频?XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

智源这项名为“通过预测下一个词元进行多模态学习的多模态大模型”的成果给出了肯定的答案。该成果表明,只采用自回归路线,就可以统一多模态学习,训练出优秀的原生多模态大模型,这对于确立自回归成为生成式人工智能统一路线具有重大意义。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

记者了解到,长期以来,AI在学习不同类型的“感官”信息时,往往需要“分科而治”——理解文字用一套方法,生成图片用另一套,处理视频又需要不同的专业模型,过程复杂且协同起来较为困难。而智源研究院研发的Emu3模型,借鉴了GPT成功的关键思路“预测下一个词元”,成功统一了对文本、图像及视频的理解与生成能力。打个比方,就如同给AI找到了一个“万能学习法”,无论面对的是一段文字、一张照片,还是一段动态影像,AI都用同一种逻辑去分析和创造。实验表明,这种统一方法在图片生成、图文理解和视频创作等多个任务上,达到了与当前各类专用模型相当的水平,且具备更强的扩展潜力和通用性。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

《自然》编辑点评这项研究时表示,基于“预测下一个词元”,Emu3实现了大规模文本、图像和视频的统一学习,其在生成与感知任务上的性能可与使用专门路线相当,这一成果对构建可扩展、统一的多模态智能系统具有重要意义。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

值得一提的是,基于这一核心路径的迭代版本Emu3.5模型,已展现出对物理世界运行规律的初步学习与模拟能力,能够尝试预测场景的下一步变化,为发展更通用、更接近人类认知方式的大模型与智能体奠定了基础。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

据悉,自2020年启动“悟道”大模型研究以来,智源研究院持续聚焦大模型的原始创新与长期技术路径探索。2025年6月,智源发布新一代大模型系列成果“悟界”,目标是构建人工智能从数字世界迈向物理世界的关键能力,打造物理世界的人工智能基座模型。该系列模型包括:Emu系列多模态世界模型、RoboBrain跨本体具身大脑、数字孪生心脏、Brainμ脑科学多模态基础模型以及OpenComplex全原子生命模型等,共同构建起覆盖宏观具身智能、介于宏观和微观尺度的生命系统到微观构象动力学的多层次技术基座。XP3速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

记者3月20日从中国科学技术大学获悉,该校郭光灿院士团队在量子态分辨研究中取得重要进展。研究组在最小资源消耗的量子态分辨问题中首次提出了全局最优自适应策略,并发展了自适应集体测量实验 据韩国建国大学研究人员发表在最新一期开放获取期刊《公共科学图书馆·综合》上的一项研究,与狗共度美好时光可减轻压力,同时可增强与放松和注意力相关的脑电波。动物辅助干预措施,如犬类 21世纪经济报道记者王峰北京报道 近日,全球教育集团培生(NYSE:PSO)公布2023财年财报。2023财年,培生的销售额为36.74亿英镑(下同),同比下降4%,但基础销售额同比增长1%;调整后营业利润5.73亿,同 3月21日记者从中国科学技术大学获悉,该校物理学院张斗国教授课题组,提出并实现了一种基于矢量光场调控原理的动量空间偏振滤波器件。科研人员将该滤波器件安装于传统无标记光学显微镜的出射端, 美国和法国的科学家联合团队借助新的3D打印技术,开发出一种多层人造皮肤,只需18天即可长成。这种仿真皮肤可用于提升护肤品测试效率,并催生更好的皮肤治疗方法。相关研究发表于新一期《先进功能 3月22日,中国互联网络信息中心(CNNIC)在京发布第53次《中国互联网络发展状况统计报告》。报告显示,截至2023年12月,我国网民规模达10.92亿人,互联网普及率达77.5%;网络基础设施建设持续加强,新型消费 。

本文链接:京产大模型成果登上国际顶级期刊http://www.sushuapos.com/show-2-15082-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 我们为什么一定要“星际航行”

下一篇: 探访全国首家人形机器人7S店

热门资讯

  • 多功能金纳米花颗粒 可促进感染性组织修复

    3月17日,记者从海南大学获悉,该校化学化工学院副教授李萌婷与相关研究团队合作,合成了多功能复合金纳米花颗粒。该颗粒配合温和光热、光动力、药物控

  • 人工智能探究癌症发展机理

    据英国《金融时报》网站3月13日报道,科学家们已经在利用人工智能(AI)阐释人体所谓的“黑暗基因组”,并开发一种可能很强大的癌症检测、监测和治疗新

  • 人工智能重新定义职场技能

    据阿根廷布宜诺斯艾利斯经济新闻网2月19日报道,在人工智能(AI)迅速重新定义就业格局的今天,通常被称为“软”技能的人类技能成为最有韧性、最有价值

  • 新疗法可有效治疗多发性骨髓瘤

    据埃菲社报道,多发性骨髓瘤是成年人中继淋巴瘤之后第二常见的血液肿瘤。最近,西班牙的一个科研团队开发出了一种新的免疫疗法来对抗它。实验室实验表

  • 国家工程师丨锻造能“听”清眼疾的高精设备

    眼眸深邃似海、璨如星河,中国医学科学院生物医学工程研究所眼科诊疗技术研发团队(以下简称“团队”)正是眼眸“侦探”。该团队不久前被授予“国家卓越

  • 我国建立“天-空-地-深”一体化铀矿勘查技术体系

    记者3月21日从核工业北京地质研究院(以下简称核地研院)获悉,该院自1959年成立以来,在天然铀保障、高放废物地质处置、核遥感技术与应用、分析测试等领

  • 新疆筹建国家级融合算力中心

    记者从近日举办的新疆筹建融合算力中心研讨会上获悉,新疆将构建具备国家级算力水平的涵盖超算、智算的融合算力中心。到2024年底,建成超算算力(FP64)不

  • 单个颗粒无标记光学显微成像实现

    记者3月21日从中国科学技术大学获悉,该校物理学院张斗国教授课题组,提出并实现了一种基于矢量光场调控原理的动量空间偏振滤波器件。该滤波器件安装

  • iPhone可能在国内设备使用百度AI技术:集成于iOS 18

    有消息称,iPhone在中国寻找本土生成式AI提供方,iPhone讨论了在中国的设备中使用百度的人工智能技术。据《华尔街日报》报道,iPhone与百度进行了谈判,以授权

  • 新疆:南山26米射电望远镜4Gbps宽带VLBI联测首获成功

    记者从中国科学院新疆天文台获悉,近期南山26米射电望远镜在参与欧洲VLBI网组织的联测中,首次成功运用4Gbps宽带、高码率VLBI技术获得干涉条纹。相较

  • 中国气象局发布大地磁暴预警,可能会看到极光

    记者从中国气象局了解到,3月24日、25日和26日三天,将可能出现地磁活动,其中3月25日可能发生中等以上地磁暴甚至大地磁暴,预计地磁活动将持续到26日。在

  • 中广核:用创新技术提升核电站“智”力

    在近日开幕的中国国际核工业展览会上,中国核学会理事会党委书记、理事长王寿君表示,中国内地现有在运核电机组55台、居全球第三;在建核电机组26台,保持

推荐资讯

  • 日榜
  • 周榜
  • 月榜