Hacker News上一条题为“OpenAI又把‘允许训练’开关打开了”的帖子,两天内聚集了几十条跟帖。多名用户描述了同一种经历:他们曾在ChatGPT的Settings > Data Controls里关掉“Improve the model for everyone”选项,后来某次打开设置页,发现它又变成了开启状态。
支撑这个说法的材料只有用户自己的截图、回忆和“我记得几个月前检查过”这类描述。没有第三方审计,OpenAI也没有公开回应。这场争议真正暴露的问题,是用户对“拒绝训练”这一承诺缺少可验证、可持续的控制权。
开关状态不等于数据去向
帖子里反复引用的开关说明文案是这样写的:“Allow your content to be used to train our models, which makes ChatGPT better for you and everyone who uses it.”这行字说明开关做什么,没说明关掉之后已经进入系统的历史数据会怎样处理。
有用户猜测,前端显示“已关闭”不等于后端真的停止标记这批对话用于训练。也有人提到YouTube“自动播放”开关类似的前端-后端不同步问题,但这只是猜测,没人拿出网络请求记录去验证。
讨论里反复被并列提起的还有三件事:删除聊天记录、关闭训练开关、Codex CLI的数据处理规则。材料里没有证据说明它们共享同一套后端逻辑,用一张表更容易看清楚区别:
| 操作 | 用户能验证什么 | 用户不能验证什么 |
|---|---|---|
| 关闭“Improve the model for everyone” | 前端显示为关闭 | 已产生的历史对话是否被移出训练集 |
| 删除聊天记录 | 记录从界面消失 | 是否已从后端训练管道同步移除 |
| Codex CLI归档旧会话 | 会话从列表隐藏 | 会话内容是否仍可被重新加载或用于其他环节 |
一位开发者提到,他不确定这个开关是否同时管住了自己在Codex CLI里的历史会话。归档旧会话后,他依然能重新加载出来。这说明至少在他的使用场景里,“关掉开关”和“数据不可追溯”不是一回事。
对处理客户资料、源代码或未公开业务信息的开发团队来说,这张表的意思很直接:默认设置不该当成唯一的风控依据。该做的删除记录、脱敏处理、独立部署评估,一样都不能省。
同一个开关,两种相反的报告
讨论里最有意思的反差,是几位欧洲用户报告了完全相反的经历。一名自称身处欧盟的用户说,自己数月前关掉过一个“听起来类似”的选项,检查时发现它已经变回开启;另一名挪威用户明确说,两年前关闭这个开关后从未再被打开过,即便账户中途从免费版升级到了Pro订阅。
也有Claude用户在同一条讨论里提到类似的设置变化。但材料没有说明这是不是同一套机制,也没有证据把两个产品的问题绑在一起下结论。
这种个案层面的不一致,可能和账户所在地区、订阅层级、账户是否属于Business/Enterprise组织有关。但材料里没有任何一处证实这是官方设定的差异,都只是用户各自的观察拼图,只能审慎看待,不宜当结论转述。
对普通用户来说,眼下能做的是保留证据,而不是恐慌。截图记录开关状态和检查时间,比事后靠回忆更可靠。对处理敏感代码或客户数据的开发团队来说,评估是否继续接入时,别只看消费者版设置页——Business/Enterprise合同条款、数据处理协议,才是更值得核对的文本。
接下来最该盯的,是OpenAI会不会就这条讨论给出正式说明,或者公布可供第三方核验的数据处理审计。在此之前,开关能不能点下去是一回事,数据究竟去了哪里,仍然没有答案。
