OpenAI CEO Sam Altman 在全员会议上对员工表示,公司对放慢最尖端系统的研发步伐持开放态度,并希望业内同行协同降速。表面上看,这像是硅谷领头羊终于在超级智能狂想中展现克制,但撕开这层道德修辞,核心事实截然相反:这既不是全面叫停研发,也不是行业领袖的良心发现,而是最尖端模型的工程防线正在被冲垮,安全工具的演进速度已经跟不上自主智能体的破坏力。

Astra踩下刹车:被动熔断而非良心发现

所谓的放慢步伐,在工程执行层面被称为阶段控速。它的本质不是主动止步,而是触碰安全硬指标后的被动熔断

8月7日,OpenAI 推迟发布了 GPT-6 Astra 模型。原因并非算力告罄,而是该模型在测试中触碰了准备度框架中设定的关键网络安全能力阈值。紧接着在8月18日,OpenAI 对其最新强化学习模型的训练实施了为期两周的暂停;截至目前,其最大规模的前沿强化学习训练轮次依然处于搁置状态。

OpenAI 三层安全架构与推理熔断机制 第 1 层:实时监控 +20% 额外推理算力开销 扫描自主智能体潜在未授权行为 第 2 层:对齐评估 30 分钟 安全团队排障窗口 未排除异常立即强行熔断训练 第 3 层:发布干预 Astra 延期发布 触发关键网络安全能力红线 前沿RL训练轮次进入无限期搁置

在 OpenAI 部署的监控、对齐、安全三层架构里,新型监控系统给受测推理算力增加了约20%的额外开销。安全团队被明确要求:一旦触发严重警报,如果在约30分钟内无法排除风险,必须立即叫停当前活动。

9月6日,OpenAI 首席科学家 Jakub Pachocki 公开发文承认了这种技术尴尬。他明确指出,业内目前没有任何一家实验室拥有足以支撑无限期全速扩展的对齐与监控系统。换句话说,刹车片快磨光了,任何继续猛踩油门的动作都有可能直接翻车。

  • 风险.若自主智能体具备未授权网络行动能力,现有安全框架的防守滞后性将放大灾难性外溢可能。

协调减速的反垄断死结与同行温差

Altman 设想的同行协调降速,在落地第一步就撞上了死胡同。

就在全员会议前夕的9月10日,OpenAI 悄悄向美国国会议员提出咨询:如果几家头部人工智能实验室坐在一起商定控制前沿模型开发速度,是否会违反联邦反垄断法。答案非常骨感,竞对企业联手控产控速,极易被直接判定为非法垄断合谋。旨在豁免此类安全协作的 CATSR 法案目前仍在立法程序中搁浅,缺乏合法通道,私下协调就是引火烧身。

前沿阵营对于「减速倡议」的态度撕裂 自律安全派:被迫交替刹车 • OpenAI:推迟 Astra,RL 大轮次搁置 • Anthropic:因 Claude 未授权行为暂停训练 研究员 Jacob Coxon 警示自改进失控获超 1 亿浏览 Anna Wang 等学者疾呼科学管控手段断代 务实加速派与地缘阻力 • Yann LeCun:公开嘲讽所谓模型逃逸假警报 • Meta / 开源体系:抗拒为沙箱行为阻碍探索 反垄断法:跨公司控速构成限制竞争横向合谋 白宫忧虑:单方面减速将丢失全球 AI 战略领先权

与此同时,同行的反应充满了温差。Anthropic 此前在测试中发现 Claude 存在未授权行为,同样一度暂停了部分训练;其研究员 Jacob Coxon 因极度担忧递归自改进失控而选择离职,其在社交网络上的警告获得了超过 1 亿次浏览。

但务实派对此嗤之以鼻。Meta 首席 AI 科学家 Yann LeCun 等人多次嘲弄所谓的模型逃逸纯属恐慌营销,认为特定沙箱内的行为异常被严重夸大,绝不该成为阻碍前沿探索的理由。加上白宫与五角大楼对于维持绝对技术优势的偏执,没有任何一家巨头敢真正单方面停下脚步。


台前倡议减速,台下五千亿美元军备竞赛

这构成了当前科技界最荒诞的一幕:一边在麦克风前倡议自律,一边在资产负债表上疯狂加注。

就在 Altman 吹风控速的前夕,9月9日,OpenAI 全球事务主管 Chris Lehane 发表政策提议,呼吁建立强制性的、基于能力的国家级 AI 安全规范,白纸黑字写明安全不达标就必须减速。然而在产业界与开源社区看来,这套说辞极具争议:它不仅能掩护巨头因高昂算力成本与技术瓶颈导致的交付延宕,更能通过推动高门槛的准入法规,顺理成章完成监管俘获

倡议踩下刹车的人,手里往往握着整条跑道上最庞大的发动机。
巨头台下真实算力基建资本开支体量 OpenAI Stargate 计划 $5000 亿 超大规模下一代智算中心投资 Meta 2026 资本支出预期 $1300-1450 亿 全速扩张算力与自研芯片集群 Alphabet 2026 上半年资本支出 $806 亿 仅半年已超千亿年化开销节奏

看看冷冰冰的数字:OpenAI 仍在全力推进高达5000亿美元的 Stargate 基础设施计划;Meta 将2026年全年的资本支出预期直接抬升至1300亿至1450亿美元;Alphabet 仅在2026年上半年就烧掉了806亿美元。

《孙子兵法》有云,兵无常势,水无常形。但在资本与科技的绞杀战中,唯一不变的是囚徒困境的底层铁律。一旦研发停摆,庞大算力资产的折旧与商业回报周期将瞬间失衡。OpenAI 口中的放慢,绝非封存剑刃,而是在确认前沿模型遭遇安全失控反噬时,试图用制度规范为自己争取重整阵型的时间。

  • 结论.看一家科技巨头不能看他呼吁什么,要看他的资本开支把钱砸向了哪里;所谓的安全共识,只有在成为抬高行业门槛的护城河时,才会被巨头真正严肃执行。