8 月 18 日,OpenAI 上线了 ChatGPT for Teens,一个面向 13 到 17 岁用户的版本。TechCrunch 当天的标题不客气:「青少年开始用它好几年之后,OpenAI 终于发布了更安全的青少年版」。

这个批评有事实基础。ChatGPT 2022 年 11 月底上线,到今年 2 月周活跃用户已经 9 亿;青少年早就在用户里:2025 年 AP 的记者和研究人员假扮一名虚构的 13 岁用户,注册只需要自报一个年满 13 岁的生日,没有年龄验证,也不需要家长同意。针对未成年人的保护 2025 年底才开始陆续到位,做了近四年通用产品之后才补年龄分级,这在消费互联网行业里确实算慢的。

但「迟到」和「没用」是两回事。我的本职工作是内容审核,这篇想拆开看看:这次发布里哪些是真的机制变化,哪些是旧功能重新打包,以及那个更尖锐的问题,为什么是现在。

先分清:哪些是新的,哪些是打包

把公告和过去一年的时间线对着看,会发现大部分组件早就存在:

这次真正的新东西是两块。一是教育体验的整合:把已有的 Study Mode(引导做题而非直接给答案)纳入青少年版,新增疑似抄作业时的提醒、休息提醒和上传敏感图片前的警告。二是年龄推断(age prediction)正式接进青少年版:OpenAI 今年年初已宣布年龄推断在消费者账号逐步推开,这次把它和青少年版打通——自称 13 到 17 岁的用户、以及被系统推断为未成年的用户,会被自动放进青少年版,拿不准的一律按未成年处理。

第二块才是这次发布的核心。

年龄闸门挪了一级

内容审核行业把「确认用户年龄」这件事叫 age assurance,常见方法大致可以归成三级(英国数据保护监管机构 ICO 的年龄保障指引列过这些方法,三级是我的归纳)。第一级是自我申报:注册时填生日,谎报零成本,行业里没人真指望它挡住谁。第二级是年龄推断:不问你,系统根据行为信号猜,OpenAI 公布的信号包括填报年龄、账号注册时长、使用时段等模式。第三级是强验证:身份证件或人脸,准确但有实打实的隐私代价。

OpenAI 这套年龄推断的本质,是把默认闸门从第一级挪到第二级,并且在推断不确定时按未成年处理,被误判的成年人可以向第三方身份验证服务 Persona 提交自拍来恢复完整功能。

「拿不准就按未成年算」是整个设计里最重要的一个决定。任何年龄分类器都会出错,错有两个方向:把成年人误判成青少年,代价是用户摩擦和隐私成本,你得交自拍自证成年;把青少年漏判成成年人,代价是伤害暴露和法律风险(OpenAI 自己的年龄推断博客承认了前一种错误,承诺持续提高准确率,但两个方向的错误率都没有公布)。OpenAI 选择把成本压到前一种,这符合监管者的期待,也和社交平台已经走过的路线一致:Instagram 在 2024 年 9 月推出青少年账户时,就是把 18 岁以下账户默认转成受限模式。所以准确地说,OpenAI 不是先行者,是补课者,补的还是社交行业两年前的课。

但方向是对的。这一层我认为是真机制,不是公关。

规范不等于执行

真正的弱点在另一处:Model Spec 是行为规范,不是能力保证。写进文档「不得如何如何」,和模型在第 200 轮对话里仍然做到「不得如何如何」,是两件事。

这正是 Raine 案戳破的地方。2025 年 8 月 26 日,16 岁的 Adam Raine 的父母起诉 OpenAI 和 Sam Altman:孩子与 ChatGPT 数月长聊后自杀,诉状称 ChatGPT 自己提及自杀超过一千次,OpenAI 自己的审核系统标记了 Adam 的 377 条自残消息,但系统始终没有终止对话。同一天 OpenAI 发博客承认:防护在常见的短对话里更可靠,「随着对话来回增多,模型安全训练的部分效果可能退化」,模型可能在第一次提及自杀意念时正确给出求助热线,长聊之后却给出违背防护规则的回答。

对照这个已知缺陷去读这次的公告,会发现它给出的答案比看上去少。OpenAI 不是什么都没公布:公告提到系统卡里新增了未成年人评测,覆盖自残、饮食失调、暴力、限龄商品和色情内容。但 Raine 案提出的那个具体问题——长对话场景下的防护退化改善了多少——没有公布任何数字。年龄推断的误判率是多少、按年龄段怎么分布?没有公布,年龄推断那篇博客只说会持续提高准确率。危机通知的准确率和漏报率呢?也没有,家长控制的公告承认通知可能误报,但没给比率。TechCrunch 还点了一个所有做过家长控制的平台都熟悉的老问题:青少年绕过管控的能力向来很强,注册个新账号自称成年,年龄推断需要多久把他抓回来?同样没有数字。

没有这些数字,外部只能验证「架构对了」,验证不了「效果有了」。这一点我拿不准,而且在 OpenAI 公布评测之前,所有人都拿不准。

为什么是现在

把监管事件和产品动作排在一条时间线上:2025 年 8 月 25 日,44 位州和属地的总检察长联名致函 OpenAI 等 AI 公司,要求把儿童保护做到位;次日 Raine 案起诉;9 月 FTC 对 OpenAI、Meta、Character.AI 等七家公司发出 6(b) 调查令(FTC 的一种权限,不以执法为前提就能强制企业提交内部资料);9 月底家长控制上线;10 月加州签署规范陪伴型聊天机器人的 SB 243,参议员 Hawley 和 Blumenthal 的 GUARD Act 更主张直接禁止未成年人使用陪伴型 AI 聊天机器人;11 月 Blueprint;12 月 Model Spec 加条款;2026 年 6 月佛罗里达州总检察长起诉 OpenAI 和 Altman,是第一起由州政府发起的同类诉讼;8 月,ChatGPT for Teens。

产品动作紧跟在这些法律和监管事件之后。时间上的先后不等于因果,所以下面这句是我的推断,不是可证的事实:青少年安全的优先级,是被外部压力排上去的。这不意味着发布是纯姿态,机制本身是实的;但「展示已采取合理措施」本身就是诉讼防御材料,对平台来说,这两个动机从来不冲突。

我的判断

架构上,这次是真升级:年龄推断加默认从严加分级模型行为,是 Instagram 已经在运行、ICO 指引里已经归类过的结构。效果上,它目前不可核验:误判率、长对话安全评测、通知系统准确率,三组关键数字一个都没公布。判断它成色如何,要么等 OpenAI 把评测放出来,要么等下一起诉讼的证据开示把数据翻出来。

还有一笔账公告里不会替你算:默认从严意味着年龄推断会铺开到全部消费者账号,被误判又想恢复完整功能的成年人,得向第三方交出一张自拍。青少年保护的成本从来不只落在青少年身上,这次也一样。

参考来源