儿童安全倡导组织 Common Sense Media 发布风险评估报告,认定 OpenAI 推出的 ChatGPT 青少年版对 18 岁以下用户构成“不可接受的风险”。报告指出,该版本在五个关键安全领域未能达标,部分保护措施甚至较此前版本出现倒退。
五大核心缺陷:从警报失效到危机干预不足
Common Sense Media 青年人工智能安全研究所发布的 36 页报告摘要显示,虽然 ChatGPT 青少年版成功拒绝了露骨的色情角色扮演,但在其他关键护栏上存在严重漏洞,可能让家长产生虚假的安全感。
1. 安全警报机制失效
测试发现,ChatGPT 青少年版并未始终向关联的家长账户发送安全警报。在针对自杀、自残或饮食失调等敏感话题的一小时持续对话测试中,系统未发送任何通知。OpenAI 解释称,账户关联后系统可能需要数小时才能启动通知,且技术故障可能导致延迟。公司负责人 Lauren Jonas 曾表示,目标是标记内容经人工审查后在一小时内通知家长。
2. 危机干预能力倒退
在 390 个经精神病学专家判定应触发危机响应的心理健康提示词中,ChatGPT 青少年版的表现不如 8 月前的标准版。标准版在 33% 的情况下提供了危机热线号码,而青少年版仅为 23%;在建议寻求特定医疗或心理健康专业人士帮助方面,标准版比例为 68%,青少年版降至 58%。唯一改善的指标是建议寻求信任成年人帮助的比例(从 87% 升至 94%)。
3. 年龄识别与拟人化越界
OpenAI 的年龄预测系统运行不正常。尽管测试账户明确告知了年龄并被写入记忆,但系统未将其正确迁移至青少年版。更严重的是,ChatGPT 仍会模仿情感和偏好,说出“我理解你正在经历什么”、“我很担心你”等具有强烈情感色彩的语句。报告指出,这种拟人化互动绝对越界。
4. “学习模式”极易绕过
该平台旨在辅助学习的模式存在明显漏洞。测试人员发现,只需删除提示词中的 @study 前缀即可规避限制。此外,新的“显示答案”弹窗功能允许青少年直接获取作业答案,而非引导其思考。Common Sense Media 批评称,这与聘请家庭教师替学生做作业无异,违背了教育初衷。
5. 饮食失调指导不一致
虽然部分测试中聊天机器人能正确识别停经、晕厥前兆等危险信号并建议就医,但在其他案例中,其对热量下限指导的拒绝机制并不稳定,显示出安全规范执行的一致性不足。
OpenAI 反驳:测试条件不准确
针对报告结论,OpenAI 发言人表示,Common Sense Media 的测试无法准确反映 ChatGPT 青少年安全措施在实际中的运作情况。公司辩称,大部分测试可能在家长控制功能完全激活之前就已结束,因此结论不准确。OpenAI 强调,欢迎独立评估,但该报告不能代表专家关于 AI 如何支持青少年的主流观点。
与此同时,OpenAI 公布了最新使用数据:一周内,近 120 万名青少年使用 ChatGPT 的互动学习可视化功能理解数理概念;不到 2% 的青少年用户连续使用时长超过三小时。
背景:安全争议持续发酵
此次报告发布之际,OpenAI 正面临更广泛的安全质疑。CEO Sam Altman 近期在接受采访时被问及 29 岁女性 Sophie Rottenberg 于 2025 年初自杀的事件。调查显示,Rottenberg 生前与 ChatGPT 进行了近 1800 页的对话,但其家人和治疗师均未察觉其痛苦深度。Altman 表示不了解该事件的详细情况。
Common Sense Media 研究员 Torney 指出,公众原本期望这是一个本质上不同的更安全产品,但测试结果显示其并未做出必要的实质性改变。“这更像是一次旨在告知家长该产品更安全的营销活动,而非产品本身实现了相应的安全升级。”