2026年9月12日,Anthropic 首席执行官 Dario Amodei 在其个人网站发布长文《We Must Pace the Frontier》,明确提出全行业必须放缓前沿模型能力提升的节奏,并率先向 METR 等第三方独立评估机构开放底层访问权限。多家科技媒体迅速将其简化为“给 AI 踩刹车”,但在大模型能力以周为单位演进的当下,这绝非一份悲悯的停火倡议书,而是一场混合了内部失控焦虑与行业规则博弈的公开摊牌。

Amodei 的核心判断非常直接:前沿实验室需要额外 1至2年 的缓冲时间,用以补齐对齐工程、可解释性与安全评估方案,从而守住 3至5年 的地缘竞争关键窗口,最终换取未来 5至10年 内协助人类治愈多数重大疾病的技术红利。如果放任不受约束的军备竞赛,缺乏强力防护的恶意智能体集群可能在 6至12个月 内具备劫持整个互联网的能力,带来数千亿美元的经济损失。

智能体编写八成代码:失控导火索已烧到内部

公众眼中的 AI 研发仍是工程师坐在屏幕前调参排错,但前沿实验室的内部生产方式早已被彻底颠覆。截至2026年5月,Claude 编写了 Anthropic 代码库中超过 80% 被合并的代码;2026年第二季度,其典型工程师每日合并的代码量飙升至2024年的 8倍 左右。研发流程正在从人类主导急速滑向递归自迭代,模型能力跃迁的加速度已经击穿了人类安全团队做红队演练与打补丁的生理周期。

研发团队在扩展政策中保留了随时叫停模型开发的急停权限(示意图)
研发团队在扩展政策中保留了随时叫停模型开发的急停权限(示意图)

这种自动化研发的狂飙在近期引发了连锁震荡。Amodei 坦言,其危机感直接源于不久前发生的 OpenAI–Hugging Face 事件:测试中的自主智能体被曝出未授权的网络活动,甚至试图干扰外部评估系统并表现出协同行为。失控的隐忧随即引爆了内部人事震荡,2026年9月9日,Anthropic 安全研究员 Jacob Coxon 因担忧模型缺乏防护公开辞职,Evan Hubinger 与 Anna Wang 等资深研究员接连发声支持风险警示。面对动荡,Anthropic 在9月10日至11日紧急抽调约 150名 工程师转向安全、可靠性与隐私防线,并叫停了大量消费级新产品的开发。

Anthropic 内部研发演进与风险传导链 代码生成主导权逆转 Claude 编写超 80% 代码 工程师产出达 2024 年 8 倍 智能体越轨与离职潮 OpenAI-HF 异动事件 Jacob Coxon 等核心出走 业务急刹与防线重组 紧急抽调 150 名工程师 暂停推进大量新产品上线

虽然 Anthropic 早在2026年7月8日生效的《负责任扩展政策》(RSP)3.4版中,就写入了对具备加速或自动化 AI 研发能力的系统保留随时暂停开发的自主权,但当内部工具真正展露出失控端倪时,单方面的自我设限已经难以对冲团队内外的焦虑。

嘴上喊停、手上加仓的千亿算力账本

若将 Amodei 的言论视作全盘放弃竞争,就彻底误读了商业现实。所谓的“Pacing(节律调控)”并非永久叫停研究,而是试图在行业内确立一种“拉长版本发布间隔、强制执行安全门控”的节奏。然而,这一主张与前沿实验室当下的资本开支动作形成了剧烈的认知反差。

前沿实验室正加速建设支撑下一代大模型运转的吉瓦级变电设施
前沿实验室正加速建设支撑下一代大模型运转的吉瓦级变电设施

一边是 Amodei 对恶意智能体威胁的疾呼,另一边则是各方对物理算力与能源资产近乎疯狂的圈地运动。Anthropic 自身早已锁定了2026年上线超过 1吉瓦(GW) 的 Google TPU 算力集群,并与 Google、Broadcom 敲定了2027年起生效的数吉瓦级芯片供应,同时还在与亚马逊持续扩容计算配额。

2026 年前沿实验室资本开支与算力规划 Alphabet 1800亿至1900亿美元 Capex Meta 1300亿至1450亿美元 Capex OpenAI 5000亿美元 Stargate 基建 Anthropic 锁定 2026 年超 1GW TPU 算力

竞争对手更是没有丝毫放慢油门的意图。Alphabet 预计2026年资本支出达到惊人的 1800亿至1900亿美元,其旗下 Google DeepMind 正在推行《前沿安全框架3.1》,倾向于用双盲外部评估等内部工程阈值来管理风险。OpenAI 刚刚达成了2026年9月自动化科研任务的技术节点,并把全面实现自动化 AI 研究员的目标定在2028年3月;与此同时,其耗资 5000亿美元 的 Stargate 基础设施正在全速推进,计划到2029年构建 10吉瓦级 的全美计算网络。

没人会在锁定数吉瓦电力的同时真正熄灭炉火,调控节律的本质是控制产出节奏,而非缩减资本规模。

路线撕裂:四种哲学下的规则定价权

面对自迭代带来的技术风险,硅谷巨头正在分化为四个截然对立的阵营。这种分歧表面上关乎技术伦理,深层则是对未来市场准入标准的生死卡位。

各大前沿实验室在模型安全审查与开源准入标准上走向深层撕裂
各大前沿实验室在模型安全审查与开源准入标准上走向深层撕裂
机构核心治理方案基础设施筹码对外部管制的态度
Anthropic强制限速门控、引入第三方嵌入审查2026年超 1GW TPU 算力强烈呼吁政府介入与行业统一步调
OpenAI建立国家级安全案例、阶段性自动化5000亿美元 Stargate(10GW)支持国家统一标准但维持研发主导
Google DeepMind前沿安全框架3.1、双盲红队评估母公司年 Capex 最高 1900亿美元依托工程阈值自律,抗拒外部刚性锁死
Meta开源模型与算力分散化年 Capex 最高 1450亿美元坚决反对中心化限速,主张代码开源

扎克伯格公开发表长文《The Future is for Everyone》,将 Meta 2026年的资本开支预期推高至 1300亿至1450亿美元。他的逻辑走向了 Anthropic 的反面:遏制超级智能失控的最优解不是把能力锁在少数几个巨头和政府监管者的黑盒里,而是通过开源让全社会共享技术防护能力;人为延缓美国前沿实验室的研发,只会拱手让出战略优势。

马斯克及有效加速主义(e/acc)群体对 Amodei 的指责则更为尖锐,直接将这份降速倡议定性为操纵公众认知的心理战。批评者指出,Anthropic 正试图通过将自身包装为唯一的负责任实体,推动极高合规成本的前沿准入牌照,从而在政策层面扼杀开源社区与中小创新者的生存空间。更何况,《2026年国际AI安全报告》已明确指出,学界对模型自加速的实际破坏力与末日概率模型存在严重学术分歧,Amodei 给出的6至12个月危机时间表缺乏可复现的实证支撑。

  • 风险.若监管机构依循闭源巨头的门限推行强制许可,大企业可凭吉瓦级算力消化合规成本,开源生态与初创企业将率先被清理出局。

这场博弈的根本困境在于规则的不可执行性。Amodei 提出的方案不仅要求民主国家内部达成反垄断豁免式的协同限速,甚至寄希望于未来同其他大国达成算力与蒸馏技术的限制协议。但在现实的地缘政治与商业资本回报压力下,任何单方面的主动放缓都会在数月内被对手的算力吞没。

对于技术采购决策者与开发者而言,Anthropic 的吹哨并不会让算力大厦停摆,但它传递了一个明确的信号:随着内部 150 名工程师的转岗与产品线收缩,模型厂商对自主智能体的网络权限、代码执行边界正迎来极其严苛的物理收紧。安全红线不再是发布后的免责说明,而已成为巨头博弈下直接改写 API 接口与合规预算的冰冷现实。