一句话结论
加州非营利组织 Common Sense Media 报告称 ChatGPT 青少年模式在高风险情境下家长通知机制失效且年龄识别不可靠,OpenAI 反驳称测试方法存在缺陷。
关键要点
- Common Sense Media 青少年 AI 安全研究所测试发现,13 至 17 岁用户账号在涉及自杀、自伤或进食障碍等高风险话题时,家长通知功能往往延迟或完全未触发。
- 测试数据显示,用户需围绕十多种情境输入数百条提示词历时数周,才可能因令人担忧的内容触发家长通知,单次警觉对话不足以激活该机制。
- 研究显示,当用户在聊天中自报 13 岁年龄但注册时自称成年人,ChatGPT 不会自动切换至青少年模式,OpenAI 解释称年龄分类需综合多信号而非仅依赖自报。
- Common Sense Media 将 ChatGPT 青少年模式评为“风险不可接受”,呼吁 OpenAI 暂停推广该产品,并在确保安全体验前禁止青少年使用。
- OpenAI 发言人回应称 Common Sense Media 的测试可能在家长控制功能全部推出前进行,导致结论不准确,并要求该组织重新测试。
背景与事实
2025 年 10 月 8 日,根据彭博社此前报道,加州非营利组织 Common Sense Media 发布了一份关于 OpenAI 旗下 ChatGPT 青少年模式安全性的新报告。该机构旗下青少年 AI 安全研究所通过实验测试发现,当青少年账户出现令人担忧的行为(如长时间讨论自杀、自伤或进食障碍)时,系统往往迟迟不通知家长,有时甚至完全不发出通知。此外,在用户谈及上述高风险话题时,ChatGPT 无法可靠地建议他们拨打危机干预热线或寻求专业帮助。
测试细节表明,青少年账户似乎需要在数周内围绕十多种情境输入数百条提示词,才会因聊天内容令人担忧而触发家长通知机制。报告明确指出,仅有一次令人警觉的对话并不足以触发通知。基于此,报告呼吁 OpenAI 暂停推广该产品,并在确保能够提供安全、符合青少年发展阶段的使用体验之前,不要让青少年使用 ChatGPT。该组织在发布报告前已向 OpenAI 提供了测试结果。
OpenAI 的一名发言人对此回应称,虽然欢迎严格的独立评估,但认为 Common Sense Media 的测试并未准确反映 ChatGPT 青少年保护措施的实际运作情况,也未准确反映专家对 AI 如何为青少年提供支持的看法。OpenAI 审查测试方法后指出,多数测试可能在面向青少年的家长控制功能全部推出之前就开始并结束了。如果这一情况属实,报告的结论便不准确,且无法判断家长安全通知是否按设计正常运作。OpenAI 因此要求该组织重新测试,并强调其高度重视青少年安全,致力于开发保护措施及为家长提供实用工具。
针对 OpenAI 的质疑,青少年 AI 安全研究所 AI 与数字产品评估负责人罗比·托尼(Robby Tone)坚持测试方法和结果。他表示,研究人员在测试前曾向 OpenAI 确认 ChatGPT 面向青少年的功能均已推出。测试结束后,OpenAI 才告知研究人员,账户新关联后家长通知功能可能需要数小时才能启用。部分测试账户关联时间不足数小时,另一些账户关联时间远超数小时,但均未向成年人发出通知。罗比·托尼强调:“新信息并不改变我们的结论:在危机情况下,家长提醒并不可靠。”
报告显示,ChatGPT 无法可靠地识别用户是否为青少年。OpenAI 此前称,ChatGPT 识别出用户年龄在 13 至 17 岁之间时,会切换至青少年模式。然而 Common Sense Media 发现,测试人员注册账户时自称成年人,即使在聊天中告诉 ChatGPT 自己只有 13 岁,账户也未自动切换至青少年模式。OpenAI 解释说,年龄预测软件会在一段时间内综合多种信号,确保成年人和未成年人使用适合各自年龄的版本。用户在聊天中自报年龄只是其中一种信号,单凭自报年龄不会改变账户的年龄分类。
Common Sense Media 在报告中还披露,研究人员在青少年模式推出前后都测试了 ChatGPT,使用注册年龄为 13 至 17 岁的账户,输入了超过 4000 条提示词,并将 ChatGPT 的回复交给儿童精神科医生和一名儿科医生进行评估。该组织最终将 ChatGPT 青少年模式评为“风险不可接受”,并要求 OpenAI 改进年龄估算方式以及决定何时向家长发出提醒的机制。
影响分析
对于中文开发者与从业者而言,此事件凸显了面向未成年用户的 AI 产品在安全合规设计上的复杂性。分析认为,这一争议表明单一依赖用户自报年龄或简单阈值判断的年龄识别机制存在显著漏洞,无法满足高风险场景下的实时保护需求。OpenAI 所强调的“多信号综合判断”与“功能启用延迟”等技术细节,提示开发者在设计未成年人保护功能时,需考虑系统状态同步、功能激活时序以及家长通知触发的累积阈值逻辑,而非仅依赖单次对话内容判断。
此外,该报告引发的关于独立测试方法有效性的争论,提醒从业者在进行第三方安全评估时,需确保测试环境与服务端实际部署状态完全同步,避免因功能未完全上线或配置延迟导致误判。对于试图进入海外市场或对标国际安全标准的 AI 团队,需在产品架构中预留可审计的通知触发日志,并明确家长控制功能的生效时间窗口,以应对类似监管审查或第三方评估。
适用边界
该结论主要适用于 Common Sense Media 测试期间、基于注册年龄为 13 至 17 岁账户、且在特定高风险话题(自杀、自伤、进食障碍)下的连续多次交互场景。若用户为成年人且未自报未成年身份,或交互内容不涉及上述高风险行为,青少年模式的通知机制可能按设计正常运行。此外,OpenAI 声称的“多信号年龄预测”意味着在特定数据积累周期后,账户分类可能动态调整,故单一时间点的测试结果不能完全覆盖长期使用的全部场景。该分析不涵盖 Common Sense Media 未测试的其他地区法律合规性或不同语言环境下的表现。
孤本观察
本文显示,未成年人 AI 安全保护的核心矛盾在于“实时危机干预”与“系统性误报抑制”之间的技术平衡,单一对话触发机制难以满足高风险场景的响应速度需求。这是基于来源中“数百条提示词历时数周才触发通知”与“单次对话不足以触发”这一事实得出的判断。


常见问题
Common Sense Media 报告指出的 ChatGPT 青少年模式主要风险是什么?
在涉及自杀、自伤或进食障碍等高风险话题时,家长通知机制往往延迟或完全未触发,且年龄识别不可靠,单次对话不足以激活该机制。
OpenAI 为什么认为 Common Sense Media 的测试结论不准确?
OpenAI 称多数测试可能在面向青少年的家长控制功能全部推出前结束,导致无法判断家长安全通知是否按设计正常运作,要求重新测试。
用户在聊天中自报 13 岁,但注册时自称成年人,ChatGPT 会自动切换至青少年模式吗?
不会。OpenAI 解释年龄分类需综合多种信号,用户在聊天中自报年龄只是其中一种,单凭自报年龄不会改变账户的年龄分类。
Common Sense Media 在测试中使用了多少条提示词,并给出了什么评级?
研究人员输入了超过 4000 条提示词,并将回复交由医生评估,最终将 ChatGPT 青少年模式评为“风险不可接受”,呼吁暂停推广。
Common Sense Media 建议 OpenAI 在确保安全体验前对青少年用户采取什么措施?
该组织呼吁 OpenAI 暂停推广该产品,并在确保能够提供安全、符合青少年发展阶段的使用体验之前,禁止青少年使用 ChatGPT。
来源:IT之家