英国谷歌深度思维公司的科学家开发了一种能为大语言模型生成的文本添加水印的工具,能提高对合成内容的鉴别和追溯能力。相关研究近日发表于《自然》。
大语言模型(LLM)是广泛使用的人工智能(AI)工具,能为聊天机器人、写作支持和其他目的生成文本。不过,人们很难识别并追溯AI生成文本的来源,使信息的可靠性成疑。水印被认为能解决这一问题,但生产系统对质量和计算效率的严格要求阻碍了其规模化应用。
深度思维公司的Sumanth Dathathri、Pushmeet Kohli和同事开发了一个利用一种全新采样算法给AI生成文本添加水印的系统,称为SynthID-Text。该工具利用一个采样算法对LLM的词汇选择进行巧妙偏移,插入一个能被相关检测软件识别的签名。这既可以通过一种“扭曲”路径实现——该路径能提高水印质量但会轻微影响输出质量,或是通过一种能保留文本质量的“非扭曲”路径。
研究者在多个公开模型上评估了这些水印的可检测性,发现SynthID-Text的可检测性优于当前其他方法。他们还用Gemini LLM的近2000万次在线对话回答评估了这些文本的质量,结果显示非扭曲水印形式不会降低文本质量。最后,SynthID-Text的使用对LLM运行所需算力的影响可忽略不计,减少了应用上的障碍。
研究者提醒道,编辑文本或改写输出就能避免出现文本水印。但该研究证明,一个为AI生成内容的生成式文本添加水印的工具是可行的,继而有望提升LLM使用的责任制和透明度。
相关论文信息:
https://doi.org/10.1038/s41586-024-08025-4
未来,人工智能或将帮助科研工作者跳过文献检索、粗读的过程,直接找到需要的文献,大幅提升科研工作者的文献阅读效率。 人类蛋白质KRAS(蓝色)与其伴侣之一RAF1(黄色)相互作用的三维图。图片来源:西班牙巴塞罗那基因组调控中心 科技日报北京12 关于2023年第二批拟备案的省自然科学基金结题验收项目的公示 根据《河南省自然科学基金项目管理办法》(豫科〔2022 随着人们生活节奏的加快和对便捷食品需求的增加,预制菜产业正呈现强劲的发展势头。2月13日,《中共中央、国务院关于做 ·“这项研究似乎说明,长期生活在食品不安全的状况中所带来的危害是没那么容易逆转的。研究也表明,对于那些因 关于全国科普工作先进集体和先进工作者拟推荐名单的公示 根据《科技部 中央宣传部 中国科协关于评选表彰全国科普 。本文链接:他们用“水印”鉴别AI生成文章http://www.sushuapos.com/show-11-12981-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 多位诺奖得主做客顶科论坛:科学发现要让所有人能获取
下一篇: 嗅觉缺失的人呼吸方式也会不同