# OpenAI 要在 120 天内给 ChatGPT 加安全机制，下个月先上家长控制

> 原标题：Building more helpful ChatGPT experiences for everyone

- 来源：OpenAI News
- 发布时间：2025-09-02T04:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/485
- 原文：https://openai.com/index/building-more-helpful-chatgpt-experiences-for-everyone

## 摘要

OpenAI 公布了一版安全更新计划，核心是两件事：一是把检测到严重情绪危机的对话自动转给推理模型（比如 GPT‑5‑thinking）去处理，理由是这类模型在安全规范上更稳、更不容易被诱导；二是下个月内推出家长控制功能，家长可以绑定 13 岁以上孩子的账号，关掉记忆和聊天记录，并在系统判定孩子处于严重情绪波动时收到通知。正文没披露危机检测的触发阈值和...

## 推荐理由

OpenAI 说接下来 120 天要推安全改进，下个月先上家长控制。最值得看的是那条路由规则：检测到急性痛苦迹象的对话，会自动转给 GPT-5-thinking 这类推理模型处理。这比加个免责声明实在，但正文没公布触发条件和误报率，实际效果得等上线再看。青少年账户那边，家长能关 memory 和聊天记录，算是给了控制权，不过也没说默认开关状态。整体是产品动作，不是技术突破，我会先打个折。

## 锐评

OpenAI 这次公布的安全更新，核心是把高风险对话转给 GPT‑5‑thinking 这类推理模型去接。他们的逻辑是：推理模型用了“深思熟虑式对齐”训练，测试里更遵守安全规范，对抗诱导也更稳。这个思路本身不新鲜，但把路由做成实时自动切换，算是把安全策略嵌进了产品流程里。

家长控制功能下个月上线，家长可以绑定 13 岁以上孩子的账号，关掉记忆和聊天记录，并在系统判定孩子情绪波动严重时收到通知。不过正文完全没提危机检测的触发阈值、误报率，也没说通知延迟多久。这些缺口让实际效果很难判断——如果误报太多，家长会被频繁打扰；如果漏报，这套机制就形同虚设。

他们还拉了两个专家网络来背书，一个是心理健康顾问委员会，一个是全球医生网络，号称有 250 多名医生参与。但正文没说明这些专家对具体产品决策有多大话语权，只说了 OpenAI 自己承担最终责任。我会先打个折：有专家参与比没有强，但别把它当成独立审查。
