Hacker News上一条题为“OpenAI又把‘允许训练’开关打开了”的帖子,两天内聚集了几十条跟帖。多名用户描述了同一种经历:他们曾在ChatGPT的Settings > Data Controls里关掉“Improve the model for everyone”选项,后来某次打开设置页,发现它又变成了开启状态。

支撑这个说法的材料只有用户自己的截图、回忆和“我记得几个月前检查过”这类描述。没有第三方审计,OpenAI也没有公开回应。这场争议真正暴露的问题,是用户对“拒绝训练”这一承诺缺少可验证、可持续的控制权。

开关状态不等于数据去向

帖子里反复引用的开关说明文案是这样写的:“Allow your content to be used to train our models, which makes ChatGPT better for you and everyone who uses it.”这行字说明开关做什么,没说明关掉之后已经进入系统的历史数据会怎样处理。

有用户猜测,前端显示“已关闭”不等于后端真的停止标记这批对话用于训练。也有人提到YouTube“自动播放”开关类似的前端-后端不同步问题,但这只是猜测,没人拿出网络请求记录去验证。

讨论里反复被并列提起的还有三件事:删除聊天记录、关闭训练开关、Codex CLI的数据处理规则。材料里没有证据说明它们共享同一套后端逻辑,用一张表更容易看清楚区别:

操作用户能验证什么用户不能验证什么
关闭“Improve the model for everyone”前端显示为关闭已产生的历史对话是否被移出训练集
删除聊天记录记录从界面消失是否已从后端训练管道同步移除
Codex CLI归档旧会话会话从列表隐藏会话内容是否仍可被重新加载或用于其他环节

一位开发者提到,他不确定这个开关是否同时管住了自己在Codex CLI里的历史会话。归档旧会话后,他依然能重新加载出来。这说明至少在他的使用场景里,“关掉开关”和“数据不可追溯”不是一回事。

对处理客户资料、源代码或未公开业务信息的开发团队来说,这张表的意思很直接:默认设置不该当成唯一的风控依据。该做的删除记录、脱敏处理、独立部署评估,一样都不能省。

同一个开关,两种相反的报告

讨论里最有意思的反差,是几位欧洲用户报告了完全相反的经历。一名自称身处欧盟的用户说,自己数月前关掉过一个“听起来类似”的选项,检查时发现它已经变回开启;另一名挪威用户明确说,两年前关闭这个开关后从未再被打开过,即便账户中途从免费版升级到了Pro订阅。

也有Claude用户在同一条讨论里提到类似的设置变化。但材料没有说明这是不是同一套机制,也没有证据把两个产品的问题绑在一起下结论。

同一开关,两种用户报告 报告:开关疑似被重开 用户:重新订阅Claude Code 检查前几个月已关闭 再次查看时显示已开启 用户:德国账户 关闭过类似选项 再查时显示开启 报告:开关长期保持关闭 用户:欧盟地区 数月前关闭 至今仍显示关闭 用户:挪威 两年前关闭,升级Pro后 依然显示关闭 无第三方审计,两类报告都无法互相验证

这种个案层面的不一致,可能和账户所在地区、订阅层级、账户是否属于Business/Enterprise组织有关。但材料里没有任何一处证实这是官方设定的差异,都只是用户各自的观察拼图,只能审慎看待,不宜当结论转述。

对普通用户来说,眼下能做的是保留证据,而不是恐慌。截图记录开关状态和检查时间,比事后靠回忆更可靠。对处理敏感代码或客户数据的开发团队来说,评估是否继续接入时,别只看消费者版设置页——Business/Enterprise合同条款、数据处理协议,才是更值得核对的文本。

接下来最该盯的,是OpenAI会不会就这条讨论给出正式说明,或者公布可供第三方核验的数据处理审计。在此之前,开关能不能点下去是一回事,数据究竟去了哪里,仍然没有答案。