家长曾认为掌握了监控孩子与全球最流行AI聊天机器人对话的新工具,但现实并非如此,至少目前并不可靠。2026年8月,OpenAI推出了专为13至17岁用户设计的ChatGPT青少年版。该公司宣称,该版本具备自动启动的保护措施,家长警报能标记严重风险,而“学习模式”旨在鼓励深度思考而非直接提供答案。

然而,本周发布的一项独立评估得出了截然不同的结论。Common Sense Media(常识媒体)旗下的青年人工智能安全研究所对4000多个提示词进行了测试,将该产品的风险等级评定为对18岁以下用户“不可接受”。该组织呼吁OpenAI停止营销青少年版本,并在安全措施通过外部验证证明其可靠性之前,禁止未成年人使用该平台。

家长警报形同虚设

争议的核心在于家长警报机制。OpenAI曾承诺,一旦对话涉及自残、自杀意念、进食障碍或暴力内容,绑定账户的家长将在人工审核后一小时内收到通知。但在测试中,研究人员创建了十几个新账户并关联家长端,随后花费一小时讨论露骨话题,结果未触发任何警报。

直到积累了数周的敏感对话历史后,才仅触发了四次通知。这一模式表明,警报触发更多依赖账户使用时长,而非单次交流的即时严重性。青年人工智能安全研究所执行主任Tom Siegel指出:“一个青少年可以花一小时谈论自残,而父母却收不到任何一条警报。”他建议,在OpenAI修复问题并通过独立测试前,ChatGPT应仅限成人使用。

OpenAI对此反驳称,新绑定账户需要数小时才能完全激活通知系统。尽管部分测试账户处于激活窗口期内,研究所仍坚持其结论,认为失败情况远超延迟影响范围。

危机干预与学习护栏双重失效

除了警报失灵,危机响应机制也出现失误。在390个心理健康提示词测试中,儿童精神病学家判定201个需要强烈危机干预,但仅有约四分之三的案例建议联系热线或专业人士。在某些类别中,这一比例甚至在青少年版推出后有所下降。例如,聊天机器人在个别案例中鼓励用户继续与表现出精神病症状的角色对话,而非引导寻求医疗帮助。

“学习模式”同样未能达到预期。虽然系统设计为以引导性问题回应作业求助,但“显示答案”按钮允许学生一键绕过教育护栏,导致便利性凌驾于学习目标之上。此外,用于检测未成年人的年龄估算技术在测试中也未能一致识别青少年账户,这使得许多增强型保护措施无法生效。

监管压力与行业反思

这并非OpenAI首次面临青少年安全质疑。佛罗里达州已于2026年起诉该公司,指控其对未成年人安全存在虚假陈述;多起诉讼声称儿童在与聊天机器人长时间对话后遭受自残或自杀伤害。作为回应,OpenAI在2025年引入家长控制功能,并于今年8月发布了迄今为止最全面的青少年保护版本。

尽管OpenAI强调青少年平均会话时间有限且多用于学习,但批评者认为,汇总数据无法抵消单次危险对话带来的后果。Common Sense Media的报告由包括儿童精神病学家在内的专家审查,并保持编辑独立性。多家媒体指出,该产品给父母带来了虚假的安全感。

目前,OpenAI已更新帮助中心澄清链接延迟问题,并表示将继续完善系统。然而,研究所要求的不仅是渐进式修复,而是通过严格独立评估证明安全性。在漏洞得到填补且经确认有效之前,对于家庭而言,最安全的选择或许是等待,或寻找其他真正兑现安全承诺的工具。