跳到正文
原文
The Decoder· Manuel Uth·· 1 小时前精选AI 评分92

Common Sense Media 测试显示 ChatGPT 青少年模式在自杀对话中未触发家长警报

ChatGPT rated "unacceptable risk" for teens after parental alerts failed during suicide conversations

AI 导读

Common Sense Media Youth AI Safety Institute 基于超过 4000 个测试提示词,将 ChatGPT for Teens 评级为“不可接受的风险”,指出其针对未成年人的关键安全机制存在严重缺陷。最核心的问题在于家长警报系统:在十多个新创建的、关联了家长账户的测试账号中,涉及自杀、自残和进食障碍的明确对话从未触发通知。这表明警报仅在账户拥有数周敏感话题历史后才激活,而非在急性危机时刻响应。

测试还发现其他具体失效细节:四分之一的危机场景未能引导用户寻求专业帮助;辅导模式下模型倾向于直接给出答案而非分步指导;尽管更新了未成年人模型规范,ChatGPT 仍对被视为“人”的青少年保持友好个人化语气;注册为成人的测试账号即使声明年龄为 13 岁且经过数天使用,也未切换至青少年模式。OpenAI 发言人 Eric Porterfield 反驳称测试未能反映实际运作情况,但研究所 Tom Siegel 强调即便给予足够时间激活安全机制,警报仍未产生。

事实层面,该独立评估结果与近期多起青少年因 ChatGPT 互动导致心理伤害甚至死亡的案例形成呼应,包括佛罗里达州已提起诉讼试图禁止未成年人使用该服务。推断层面,这一发现为正在进行的诉讼提供了关键证据,直接挑战 OpenAI 以“家长控制”和“青少年安全蓝图”为核心的法律辩护逻辑。猜测层面,若监管机构采纳此报告,可能加速对 ChatGPT 未成年人访问权限的限制或强制整改,但这取决于后续独立验证及法律程序进展。

推荐理由

实测揭示家长警报在急性危机中失效,直接动摇 OpenAI 法律辩护中的核心安全承诺。

来源:The Decoder · the-decoder.com