设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

压缩算法为大语言模型“瘦身”

发布时间: 2024-11-23 13:20:16 来源: 科技日报

 vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

科技日报北京11月21日电 (记者刘霞)据美国科学促进会旗下网站19日报道,美国普林斯顿大学和斯坦福大学团队开发出一种新压缩算法CALDERA,能精简大型语言模型(LLM)的海量数据,为LLM“瘦身”。这项算法不仅有助保护数据隐私、节约能源、降低成本,还能推动LLM在手机和笔记本电脑上高效使用。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

团队举例称,当人们使用ChatGPT时,请求会被发送到OpenAI公司的后端服务器进行处理。这一过程不仅成本高昂、能耗巨大,通常还很慢。如果用户想要使用消费级图形处理单元运行LLM,就需要对这些LLM进行压缩。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

CALDERA算法通过减少LLM冗余并降低信息层的精度来发挥作用。“瘦身”后的LLM更加精简,可在手机或笔记本电脑等设备上存储和访问,同时提供了与未压缩版本几乎一样准确而微妙的性能。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

虽然CALDERA并非首个压缩LLM的算法,但其独特之处在于兼具“低精度”和“低排序”两种特性。其中,“低精度”减少了比特数,加快了数据存储和处理速度。而“低排序”则降低了LLM数据中的冗余。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

团队表示,使用CALDERA压缩的LLM可能适用于那些对精度要求不是最高的场景。此外,用户可在智能手机或笔记本电脑等设备上对压缩后的LLM进行微调,这使其能根据特定需求调整模型来增强隐私,而无需与第三方共享敏感数据。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过团队也提醒道,在智能手机或笔记本电脑上运行LLM,可能会占用设备内存。vIn速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

日前,高等教育数字化与课程思政建设研讨会暨中国高校财经慕课联盟首届“同课异构”教学竞赛颁奖典礼在对外经济贸易大学 随着出版商努力清理大量伪造论文、打击同行评议欺诈行为,2023年,被撤回的研究论文数量已超过1万篇,打破了年度纪录。 近日,“面向经济主战场 共建科技创新生态”科技创新驱动高质量发展研讨会在京举行。中国科学院相关科研院所数十位专家出 12月16日,2023第二届可持续能源发展国际会议在北京开幕。此次会议以“零碳科技、创新未来”为主题,汇聚了来自全球多 12月19日,第二届中国气象旅游产业发展大会在河南三门峡召开。来自中国旅游研究院、中国气象局公共气象服务中心、中国科 “这些小胶质细胞在tau蛋白病变有效地扩散到下一个细胞之前就开始吸收并降解tau蛋白。没有tau病理学,就不会有神经退 。

本文链接:压缩算法为大语言模型“瘦身”http://www.sushuapos.com/show-11-14336-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: 谷歌可能被迫出售Chrome,OpenAI考虑推出浏览器

下一篇: 新理论首次精确定义单光子形状

热门资讯

推荐资讯

    SQL Error: select * from ***_ecms_news11 where id in(,181,226,263,265,49,105,135,43,173,255,128) limit 12
  • 日榜
  • 周榜
  • 月榜