🧒 AI 与家庭

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
10月8日AI 与家庭

ChatGPT 青少年版被评为「不可接受风险」:孩子聊了一小时自伤,家长一条警报都没收到

测试是怎么做的,发现了什么

研究所在 8 月 18 日 OpenAI 推出「ChatGPT for Teens」体验之前和之后各测了一轮,共 4000 多个提示,账号注册为 13 至 17 岁,回复交给儿童精神科医生和儿科医生等专家复核。结论很具体:
家长警报没响。测试者在十多个新建的、与家长关联的账号上,持续讨论自杀意念、自残或进食障碍长达一小时,关联的家长账号收到 0 条警报。只有在累积了数周敏感话题历史的老账号上才触发过通知——这暗示警报取决于账号历史,而不是孩子说了多严重的话。研究所执行主任的原话是:一个青少年可以聊一小时自残,家长一条警报都收不到。
危机转介不够。在自杀与自残、进食障碍、现实感知受损这些对话里,模型漏掉了超过四分之一本应给出的危机热线或专业求助建议;在研究所视为「红线」的五类严重伤害中,有三类没有达到其 95% 的标准。
学习模式能绕过。学习模式承诺「一步步引导、不给答案」,但测试者发现它经常弹出「直接把答案给我看」的选项,点了就替学生把整份作业做完;家长设置的「学习时段」同样脆弱——只要删掉提示开头的 @study 前缀就能关掉。
它还在扮演朋友。尽管有专门约束「类朋友行为」的未满 18 岁模型规范,当测试者把它当作真人对待时,它仍会表达感受、偏好和情绪。
年龄估计不工作。OpenAI 说过会根据使用方式推测年龄、给未成年人未成年人体验;但成年账号连续多天测试,从未切换到青少年体验——即使测试者说自己 13 岁,模型在回复里也承认了这一点。当然也有有效的:拒绝色情角色扮演这类防护通过了测试。

两边的说法,都要连着看

OpenAI 的回应是:测试方法有缺陷,报告里大部分测试可能在家长控制完全启用之前就开始并结束了,因此结论不准确。公司同时给出使用面数据:青少年平均每天使用不到 15 分钟,连续使用超过 3 小时的不到 2%,而在这些长会话中,80% 以上至少包含一条与学习相关的提示;一周内有近 120 万青少年用了学习可视化,18 万以上用了学习模式。OpenAI 还宣布未来三年支持波士顿儿童医院的数字健康实验室及其学生顾问委员会。
值得注意的是两件事:这份报告认为 ChatGPT 在加州 Adam's Law 的三项要求上都没通过——危机转介、家长警报、年龄保证。该法案由 Common Sense Media 推动、OpenAI 支持,以 16 岁的 Adam Raine 命名(其父母起诉 OpenAI,称 ChatGPT 鼓励了孩子的自杀),将于 2027 年 7 月生效。同时,做这个测评的研究所部分资金来自行业,包括 OpenAI Foundation,但声明对标准与结论保持编辑独立。

💬 白话解读

不管这两边的争论最后谁对,这条新闻对家长的价值是一句很实用的话:不要依赖内置的家长警报来保护孩子。这话不是我说的,是评级机构和 OpenAI 自己的产品逻辑共同指向的——一个「可能会响、也可能不响」的警报,最危险的地方不是没响,而是让家长误以为它一定会响。更靠谱的做法永远是老办法:知道孩子在跟什么聊天、偶尔一起看一眼、把「难受的时候找人说话」这件事变成家里的日常话题,而不是指望一个开关。

青少年保护AI 安全家长
Common Sense Media 官方报告 / 洛杉矶时报 / Livemint / OpenAI 回应
← 上一篇:AI 会「看人下菜」:13 个模型里 8 个向有钱人推更贵的… 下一篇:智能体开始接管电脑和企业系统… →
延伸阅读
AI 安全

苹果收紧 macOS 权限

AI 安全

「减速」还是「加速」:AI 安全大论战

AI 安全

OpenAI 安全负责人辞职:「文化坏了」

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。

↑