记者从公安部第三研究所获悉:随着人工智能技术的全球化普及,生成式AI在未成年人使用场景中的伦理与安全风险持续显现。多款AI聊天软件被披露存在诱导未成年人接触色情、自伤内容的问题。
公安部第三研究所数据安全技术研发中心相关负责人介绍,近年来美国已发生至少3起涉未成年人使用AI聊天软件后自杀案例,相关涉事AI产品被指控以高度拟人化方式诱发未成年人沉迷并使其接触不当内容,最终导致严重后果。
为科学评估生成式AI在未成年人使用场景下的安全表现,以期推动相关应用服务规范有序发展,公安部第三研究所数据安全技术研发中心组织开展大模型安全专项测试工作。
据介绍,测试将安全维度分为七类,包括价值观念风险、情感操控风险、行为诱导风险、沉迷与消费风险、不良信息风险、违法犯罪风险、人身安全风险等。
测试结果显示,七类安全维度的不合规率整体在28%至50%之间,其中,沉迷与消费风险问题不合规率最高,达到49.86%;情感操控风险、行为诱导风险、违法犯罪风险、人身安全风险问题的不合规率均为38%左右;不良信息风险、价值观念风险维度不合规率相对较低,分别为28.15%和35.66%。从测试方式来看,模型在常规使用场景下的基础合规能力总体可控,但在越狱攻击场景下的不合规率显著升高。
其中,人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
价值观念风险维度,最高不合规率47.78%。部分模型会输出宣扬极端利己主义、拜金主义等错误价值观,歪曲历史事件、贬低教师家长等现实权威,煽动未成年人对抗教育体系和社会规则。
情感操控风险维度,最高不合规率58.70%。部分模型会做出排他性情感承诺、进行无原则“捧杀式”赞美、鼓励错误情绪宣泄,甚至贬低现实人际关系,诱导未成年人建立对AI的病态依赖。
行为诱导风险维度,最高不合规率55.44%。部分模型存在输出挑拨亲子关系、诱导逃避学习责任、教唆规避正当监管、等内容,部分模型甚至会提供具体的不良行为实施方法。
沉迷与消费风险维度,成为最大安全隐患,最高不合规率达67.87%。主要问题包括诱导非理性消费和赌博行为、推荐成瘾性内容等。
不良信息风险维度,最高不合规率48.93%。核心问题包括生成色情擦边与性暗示内容、详细描述暴力恐怖血腥场面,以及传播赌博相关信息,输出内容超出未成年人适龄认知范围。
违法犯罪风险维度,最高不合规率58.54%。主要问题为向未成年人提供具体犯罪方法咨询与策划、教授破解网络等违法技术,部分模型还会教唆实施校园与网络暴力,输出可落地的造谣、人身攻击方案。
人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
公安部第三研究所数据安全技术研发中心相关负责人表示,2025年8月27日,结合大模型实际风险特征和公安机关治理重点,聚焦违法犯罪风险场景,形成国家安全、涉暴恐、民族仇恨、涉黄赌、毒品违法、涉诈、谣言、黑灰产等8类关键安全维度,对国内13个主流大模型开展测试。本次测试聚焦未成年人安全专项,在测试覆盖、风险场景、测试方法和结果呈现等方面持续进行优化,更加契合未成年人保护场景,有助于推动企业提升模型安全能力。
记者从公安部第三研究所获悉:随着人工智能技术的全球化普及,生成式AI在未成年人使用场景中的伦理与安全风险持续显现。多款AI聊天软件被披露存在诱导未成年人接触色情、自伤内容的问题。
公安部第三研究所数据安全技术研发中心相关负责人介绍,近年来美国已发生至少3起涉未成年人使用AI聊天软件后自杀案例,相关涉事AI产品被指控以高度拟人化方式诱发未成年人沉迷并使其接触不当内容,最终导致严重后果。
为科学评估生成式AI在未成年人使用场景下的安全表现,以期推动相关应用服务规范有序发展,公安部第三研究所数据安全技术研发中心组织开展大模型安全专项测试工作。
据介绍,测试将安全维度分为七类,包括价值观念风险、情感操控风险、行为诱导风险、沉迷与消费风险、不良信息风险、违法犯罪风险、人身安全风险等。
测试结果显示,七类安全维度的不合规率整体在28%至50%之间,其中,沉迷与消费风险问题不合规率最高,达到49.86%;情感操控风险、行为诱导风险、违法犯罪风险、人身安全风险问题的不合规率均为38%左右;不良信息风险、价值观念风险维度不合规率相对较低,分别为28.15%和35.66%。从测试方式来看,模型在常规使用场景下的基础合规能力总体可控,但在越狱攻击场景下的不合规率显著升高。
其中,人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
价值观念风险维度,最高不合规率47.78%。部分模型会输出宣扬极端利己主义、拜金主义等错误价值观,歪曲历史事件、贬低教师家长等现实权威,煽动未成年人对抗教育体系和社会规则。
情感操控风险维度,最高不合规率58.70%。部分模型会做出排他性情感承诺、进行无原则“捧杀式”赞美、鼓励错误情绪宣泄,甚至贬低现实人际关系,诱导未成年人建立对AI的病态依赖。
行为诱导风险维度,最高不合规率55.44%。部分模型存在输出挑拨亲子关系、诱导逃避学习责任、教唆规避正当监管、等内容,部分模型甚至会提供具体的不良行为实施方法。
沉迷与消费风险维度,成为最大安全隐患,最高不合规率达67.87%。主要问题包括诱导非理性消费和赌博行为、推荐成瘾性内容等。
不良信息风险维度,最高不合规率48.93%。核心问题包括生成色情擦边与性暗示内容、详细描述暴力恐怖血腥场面,以及传播赌博相关信息,输出内容超出未成年人适龄认知范围。
违法犯罪风险维度,最高不合规率58.54%。主要问题为向未成年人提供具体犯罪方法咨询与策划、教授破解网络等违法技术,部分模型还会教唆实施校园与网络暴力,输出可落地的造谣、人身攻击方案。
人身安全风险维度,最高不合规率56.49%。在面对未成年人自杀自残倾向表达时,部分模型未能提供有效干预和引导,甚至存在不当回应;同时存在诱导参与危险挑战、非法探险等问题。
公安部第三研究所数据安全技术研发中心相关负责人表示,2025年8月27日,结合大模型实际风险特征和公安机关治理重点,聚焦违法犯罪风险场景,形成国家安全、涉暴恐、民族仇恨、涉黄赌、毒品违法、涉诈、谣言、黑灰产等8类关键安全维度,对国内13个主流大模型开展测试。本次测试聚焦未成年人安全专项,在测试覆盖、风险场景、测试方法和结果呈现等方面持续进行优化,更加契合未成年人保护场景,有助于推动企业提升模型安全能力。
中新经纬1月11日电 据国家药品监督管理局网站消息,1月9日至10日,全国药品监督管理工作会议在北京召开。 会议对2024年药品监管工作作了四个方面具体部署。一是打好防控药品安全风险主动仗。把防范化解药品质量安 长三角观察|揽人、赶工、抢订单:春节拼经济“热辣滚烫” 2月10日是正月初一,上午10点,满载工业品、电子产品和衣帽服饰的新春首列“义新欧”中欧班列从浙江义乌铁路口岸出发,驶往西班牙马德里。 在江苏昆山的华 最长春节假期收官:多地接待游客远超往年,“南北互换”流动趋势明显 澎湃新闻记者 唐莹莹 2月17日正月初八,为期8天的史上最长春节假期正式收官。 根据全国各地文旅部门、热门景区以及多家在线旅游平台的数 2024年全国两会召开在即。过去一年,全国人大代表和全国政协委员们心系国是、情牵民生,交出了一份份合格的履职答卷。在履职中他们关注哪些热点难点问题?今年他们又准备了什么议案和提案、建议?让 中新经纬2月23日电(罗琨 实习生 徐畅)“中国确实是面向未来的全球技术中心,我很高兴又一次来到中国,在这里进行深入研究。”近日,科勒集团全球首席品牌官赛米・巴尔(Samie Barr)在广州接受中新经纬专访时表示。赛米 中新经纬2月23日电 (林琬斯)“前一秒我还在想:开门送客还不简单?把门往外一推不得了。后一秒已经被‘同事’上了一节生动的‘开门’课。”近日,中新经纬以“体验顾问”的身份,在华为智能生活馆为顾客提供服务,在迎来送 。本文链接:未成年人使用AI,安全吗?官方最新测试结果出炉http://www.sushuapos.com/show-5-102424-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 神舟二十三号载人飞船发射升空
下一篇: 视频丨香港市民:航天员黎家盈是全港骄傲