OpenAI在2026年9月21日公开发布《为AI下一阶段构建标准》(Building standards for the next phase of AI)倡议,主张由美国牵头,联合各国前沿安全机构及国际标准化组织(ISO),针对递归自我改进(RSI)与自动化AI研发制定一套全球通行的技术标准。OpenAI在文件中警示,一旦模型能够完全自主迭代下一代系统,研发进度将呈现失控级爆发,因此在安全确认前不应推进全自主RSI。
这一表态看似是大厂展现治理担当的常规动作,核心玄机却藏在文末的权利边界划分里。OpenAI在提案中明确界定,这套国际技术标准本身绝不包含许可证制度或强制性预发布审批,是否具备法律约束力应完全交由各国自行立法。这场倡议并非急于给技术套上缰绳,而是OpenAI在外部监管收紧前夕发起的一次防御性制度卡位,试图用可量化的技术指标共识,替换掉可能直接叫停发布的行政许可权。
抢注度量标尺:OpenAI将行政审批剥离出国际规范
所谓递归自我改进,指AI系统自主承担下一代AI系统的科研、训练与调试工作。OpenAI在提案中承认,全自动RSI目前尚未成为现实,但模型参与自身代码编写与实验设计的比例正在攀升。为此,提案列出三项核心安全实践:量化RSI进展与自主研究占比、界定自动化研发触发即时人类审查的阈值、建立统一的事故分类跟踪与报告机制。

这套逻辑将前沿AI治理的重心从模型能力准入,悄然转移为实验室的自愿度量与透明度披露。一旦度量标准确立,实验室只需要证明自己按流程测量了自动化研究占比,并对偶发事故做了归档报告,就能在合规层面免除外部审查的直接干预。
联合国独立科学小组此前在2026年7月与9月21日接连发布报告,针对自主智能体集群失控风险亮出红灯,直言现有安全护栏已大幅落后于能力演进,呼吁参照核能与民航模式建立强约束机制。但联合国专家组仅提供了风险预警,从未为OpenAI这套弱约束的自愿性提案背书。
现实真空:现行国际框架测不出模型自我演进
OpenAI急于呼吁填补国际空白,很大程度上是因为现行技术标准在系统自主性面前几乎全线失灵。

现存被广泛引用的ISO/IEC 42001:2023标准,其条款中的持续改进针对的是企业内部的管理流程与风险控制架构,属于自愿认证性质,根本无法对具备RSI潜力的模型算法提供任何安全技术背书。美国国家标准与技术研究院(NIST)下属CAISI在2026年1月发布的《NIST AI 800-2》,仅仅是一份针对自动化基准测试最佳实践的初期公开草案,同样未触及递归演进的技术核心。
国际先进AI度量、评估与科学网络(原国际AI安全机构网络)在近期的多边磋商中,也明确把如何评估完整的AI系统而非单个静态模型列为至今无法达成共识的悬案。换言之,全球治理机构手中目前连一把能测准RSI风险的尺子都没有。
由于没有公认的工程化标尺,谁率先提出度量公式与上报框架,谁就掌握了界定失控的解释权。OpenAI此时提出由美国牵头、绑定成熟安全机构制定度量规范,正是要在全球标准成型前,确立有利于闭源商业实验室的评价坐标。
- 风险.若度量工具由具备研发利益的巨头深度定义,可能促成看似完备实则免责的合规假象,评测的高昂算力成本也容易对后发团队构成不对称壁垒。
巨头路线分歧:自愿送测、常驻核查与强制准入的暗战
在前沿AI的安全控制权上,硅谷内部从来不是铁板一块。OpenAI倡导的自愿度量与报告机制,与主要竞争对手的主张存在清晰的路线冲突。

Google DeepMind首席执行官Demis Hassabis曾在2026年7月公开建议成立由联邦监管的标准化机构,主张行业评估应当从现行的自愿送测,最终过渡到具有法律约束力的强制性部署前测试(mandatory pre-deployment testing)。DeepMind倾向于为模型发布设置硬性行政准入门槛,未能通过前置安全测试的模型不得推向市场。
Anthropic首席执行官Dario Amodei则主张更为激进的研发节律控制(pacing)。Amodei提出在前沿实验室内部派驻外部独立评估员进行常态化监督,在模型训练和迭代过程中实施介入,并在技术演进超出受控边界时主动减速。
决定技术走向的不是测量的精密度,而是谁拥有在红线被踏破时强行拔掉电源的权力。
两相对照,OpenAI的方案最为温和,也最符合商业发布诉求。它既不接受Anthropic提倡的外部常驻调查,也坚决反对DeepMind推崇的强制前置许可。OpenAI主张将审查的扳机留在企业内部,只要自主研究占比触发警报,由实验室内部的人类研究员介入复核即可。
- 结论.这一方案的核心缺陷在于度量与执行的彻底脱节,即便依靠统一标准测出高危风险,只要缺乏跨国界的独立执法权,最终发布与否仍旧取决于厂商自身的商业自律。
各国决策者接下来需要判断的,不是AI自我改进的理论破坏力有多大,而是是否要将自愿性的技术度量指标直接写入具备强制法律效力的准入法案。一旦前置审批被彻底排除在国际规则之外,留给公众的保障将仅仅是一纸事故发生后的格式化通报。
