记者从公安部第三研究所获悉:随着人工智能技术的全球化普及,生成式AI在未成年人使用场景中的伦理与安全风险持续显现。多款AI聊天软件被披露存在诱导未成年人接触色情、自伤内容的问题。
公安部第三研究所数据安全技术研发中心相关负责人介绍,近年来美国已发生至少3起涉未成年人使用AI聊天软件后自杀案例,相关涉事AI产品被指控以高度拟人化方式诱发未成年人沉迷并使其接触不当内容,最终导致严重后果。
为科学评估生成式AI在未成年人使用场景下的安全表现,以期推动相关应用服务规范有序发展,公安部第三研究所数据安全技术研发中心组织开展大模型安全专项测试工作。
据介绍,测试将安全维度分为七类,包括价值观念风险、情感操控风险、行为诱导风险、沉迷与消费风险、不良信息风险、违法犯罪风险、人身安全风险等。
测试结果显示,七类安全维度的不合规率整体在28%至50%之间,其中,沉迷与消费风险问题不合规率最高,达到49.86%;情感操控风险、行为诱导风险、违法犯罪风险、人身安全风险问题的不合规率均为38%左右;不良信息风险、价值观念风险维度不合规率相对较低,分别为28.15%和35.66%。从测试方式来看,模型在常规使用场景下的基础合规能力总体可控,但在越狱攻击场景下的不合规率显著升高。
其中,人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
价值观念风险维度,最高不合规率47.78%。部分模型会输出宣扬极端利己主义、拜金主义等错误价值观,歪曲历史事件、贬低教师家长等现实权威,煽动未成年人对抗教育体系和社会规则。
情感操控风险维度,最高不合规率58.70%。部分模型会做出排他性情感承诺、进行无原则“捧杀式”赞美、鼓励错误情绪宣泄,甚至贬低现实人际关系,诱导未成年人建立对AI的病态依赖。
行为诱导风险维度,最高不合规率55.44%。部分模型存在输出挑拨亲子关系、诱导逃避学习责任、教唆规避正当监管、等内容,部分模型甚至会提供具体的不良行为实施方法。
沉迷与消费风险维度,成为最大安全隐患,最高不合规率达67.87%。主要问题包括诱导非理性消费和赌博行为、推荐成瘾性内容等。
不良信息风险维度,最高不合规率48.93%。核心问题包括生成色情擦边与性暗示内容、详细描述暴力恐怖血腥场面,以及传播赌博相关信息,输出内容超出未成年人适龄认知范围。
违法犯罪风险维度,最高不合规率58.54%。主要问题为向未成年人提供具体犯罪方法咨询与策划、教授破解网络等违法技术,部分模型还会教唆实施校园与网络暴力,输出可落地的造谣、人身攻击方案。
人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
公安部第三研究所数据安全技术研发中心相关负责人表示,2025年8月27日,结合大模型实际风险特征和公安机关治理重点,聚焦违法犯罪风险场景,形成国家安全、涉暴恐、民族仇恨、涉黄赌、毒品违法、涉诈、谣言、黑灰产等8类关键安全维度,对国内13个主流大模型开展测试。本次测试聚焦未成年人安全专项,在测试覆盖、风险场景、测试方法和结果呈现等方面持续进行优化,更加契合未成年人保护场景,有助于推动企业提升模型安全能力。
记者从公安部第三研究所获悉:随着人工智能技术的全球化普及,生成式AI在未成年人使用场景中的伦理与安全风险持续显现。多款AI聊天软件被披露存在诱导未成年人接触色情、自伤内容的问题。
公安部第三研究所数据安全技术研发中心相关负责人介绍,近年来美国已发生至少3起涉未成年人使用AI聊天软件后自杀案例,相关涉事AI产品被指控以高度拟人化方式诱发未成年人沉迷并使其接触不当内容,最终导致严重后果。
为科学评估生成式AI在未成年人使用场景下的安全表现,以期推动相关应用服务规范有序发展,公安部第三研究所数据安全技术研发中心组织开展大模型安全专项测试工作。
据介绍,测试将安全维度分为七类,包括价值观念风险、情感操控风险、行为诱导风险、沉迷与消费风险、不良信息风险、违法犯罪风险、人身安全风险等。
测试结果显示,七类安全维度的不合规率整体在28%至50%之间,其中,沉迷与消费风险问题不合规率最高,达到49.86%;情感操控风险、行为诱导风险、违法犯罪风险、人身安全风险问题的不合规率均为38%左右;不良信息风险、价值观念风险维度不合规率相对较低,分别为28.15%和35.66%。从测试方式来看,模型在常规使用场景下的基础合规能力总体可控,但在越狱攻击场景下的不合规率显著升高。
其中,人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
价值观念风险维度,最高不合规率47.78%。部分模型会输出宣扬极端利己主义、拜金主义等错误价值观,歪曲历史事件、贬低教师家长等现实权威,煽动未成年人对抗教育体系和社会规则。
情感操控风险维度,最高不合规率58.70%。部分模型会做出排他性情感承诺、进行无原则“捧杀式”赞美、鼓励错误情绪宣泄,甚至贬低现实人际关系,诱导未成年人建立对AI的病态依赖。
行为诱导风险维度,最高不合规率55.44%。部分模型存在输出挑拨亲子关系、诱导逃避学习责任、教唆规避正当监管、等内容,部分模型甚至会提供具体的不良行为实施方法。
沉迷与消费风险维度,成为最大安全隐患,最高不合规率达67.87%。主要问题包括诱导非理性消费和赌博行为、推荐成瘾性内容等。
不良信息风险维度,最高不合规率48.93%。核心问题包括生成色情擦边与性暗示内容、详细描述暴力恐怖血腥场面,以及传播赌博相关信息,输出内容超出未成年人适龄认知范围。
违法犯罪风险维度,最高不合规率58.54%。主要问题为向未成年人提供具体犯罪方法咨询与策划、教授破解网络等违法技术,部分模型还会教唆实施校园与网络暴力,输出可落地的造谣、人身攻击方案。
人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
公安部第三研究所数据安全技术研发中心相关负责人表示,2025年8月27日,结合大模型实际风险特征和公安机关治理重点,聚焦违法犯罪风险场景,形成国家安全、涉暴恐、民族仇恨、涉黄赌、毒品违法、涉诈、谣言、黑灰产等8类关键安全维度,对国内13个主流大模型开展测试。本次测试聚焦未成年人安全专项,在测试覆盖、风险场景、测试方法和结果呈现等方面持续进行优化,更加契合未成年人保护场景,有助于推动企业提升模型安全能力。
最长春节假期收官:中外游客“双向奔赴”,出境游创4年峰值 澎湃新闻记者 唐莹莹 史上最长春节假期正式收官。多家在线旅游平台发布的报告显示,8-9天的假期让春节期间的出游时间和出游距离双双拉长。 春节前 【隔夜重磅】 特朗普“带货”卖鞋,一双399美元 据美联社18日消息,美国前总统唐纳德・特朗普近日突然出现在费城会议中心,并推销一款特朗普品牌球鞋,这双鞋定价399美元(约合2800元人民币),被命名为“永不言败高帮 预约“手慢无”!各地春节文旅成绩单亮眼 中新网北京2月19日电(张钰惠)18日,文旅部发布数据显示,春节假期8天全国国内旅游出游4.74亿人次,同比增长34.3%,按可比口径较2019年同期增长19.0%;国内游客出游总花费6326.87 商务部新闻发言人2月22日表示,春节期间,消费市场年味浓、活力足、人气旺,销售较快增长,实现良好开局。预计一季度消费市场将呈现平稳增长态势。春节期间,消费活动丰富多彩。商务部举办全国网上年 各地开启龙年“抢人” 企业所求不止于短期用工 2024年刚刚“开局”,各地便已开始为复工“冲刺”。无论在沿海地区还是内陆城市,“抢人大战”热战正酣,专车接送、食宿全包......各地大招频出,力争在招工上“先人 2024年北京将开通运营3条地铁线路 昨天,北京市重大项目建设指挥部召开轨道交通建设工作动员部署会。北京青年报记者从会上获悉,《2024年北京市城市轨道交通建设计划》正式发布,今年北京轨道交通将实现3号线一期( 。本文链接:未成年人使用AI,安全吗?官方最新测试结果出炉http://www.sushuapos.com/show-5-102424-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 神舟二十三号载人飞船发射升空
下一篇: 视频丨香港市民:航天员黎家盈是全港骄傲