哈佛大学心理学家史蒂文·平克(Steven Pinker)在《Quillette》刊发公开信,回绝了知名科技博主斯科特·亚历山大(Scott Alexander)发起的公开辩论。平克把这类存亡风险争论称为观赏性体育运动,更关键的是,他在信中罕见认错,承认自己低估了大语言模型的能力跃升,也低估了科技公司发布产品的冒进速度,但他坚决拒绝买单所谓人类灭绝的末日神话。
智能并不等于统治欲。把高级认知能力等同于毁灭人类、制造回形针的单向执念,更像是把生物进化的权力意志投射到了数学优化器身上。
实验室言行割裂与被悬置的实证
行业目前最反常的景观,莫过于最热衷渲染人类毁灭的群体,往往正是领跑最激进发版竞赛的推手。以 Anthropic 为代表的前沿实验室,管理层频繁发出存亡预警,产品却以周为单位快速迭代。
这种言行分裂背后,是安全叙事与商业现实的脱节。谨慎派代表亚历山大在博文中推演,AGI 实现的中位时间大约在 2031年,在当前安全研发投入下,AI 导致存亡级灾难的概率约为 20%,若完全任由商业利益驱动,这一概率甚至会飙升到 50%。但他同时测算,中美在越过不可逆拐点前达成完善暂停协议的概率约 40%,而美国单方面启动谈判成功的概率仅有 15%。
渲染无法落地的国际暂停协议,实际上变成了头部厂商推卸眼前责任的绝佳遮羞布。
《庄子》尝言:无为名尸,无为谋府。当灭绝预言演变为聚光灯下的显学,严肃的安全标准反而被悬空。计算机科学家斯图尔特·罗素(Stuart Russell)曾反驳平克,认为高级优化器在数学追求复杂目标时,天然会产生规避关机、争夺外部资源的次级驱动,客观上必然与人类冲突。但实证研究敲响了警钟,在针对系统行为的综述中,AI 的设定博弈拥有充分实证,目标误泛化实证较弱,而作为末日论核心支柱的寻求权力,至今实证支撑极为有限。
更具讽刺意味的是,2025 年一项针对 111 位 AI 专家的调查显示,78% 的受访者赞同技术人员必须重视灾难性风险,但仅有 21% 听说过工具性收敛。依靠少数精英圈子的形而上推演来制定全局技术政策,本身就缺乏共识基础。
迫在眉睫的近地威胁与制度补位
放弃末日神话,并不意味着技术高枕无忧。双方在实体层面的真实威胁上其实高度重叠,包括生物合成武器协助、自动化网络攻击以及缺乏权限隔离的自主智能体。
MIT AI风险库在 2026 年的专家评估中指明,未来 5 年内,24个 AI 风险领域中有 18个 存在至少 10% 的概率引发灾难性后果。危险不在于代码突然获得了自我意识,而在于具备调用外部工具能力的 Agent 在没有边界约束的环境中高速空转。《自然·机器智能》此前刊文直言,把安全过度锚定在人类灭绝上,不仅挤压了网络与生物防御研究的资源,还在政治上激起了对实用监管的阻力。
工业史上没有任何一种技术的安全保障来自恐惧动员。蒸汽锅炉靠压力阀,民航客机靠适航认证与黑匣子事故调查。平克开出的药方正是这种工业级责任工程:
- 结论.将治理重心全面切换至独立外部监督、强制性事故溯源调查、企业损害赔偿责任、人机回环控制与硬件级断电停机开关。
- 风险.若监管继续沉溺于科幻推演而放任企业裸奔部署,真正击穿社会秩序的将不是超级智能,而是未加权限沙盒的恶意利用和系统崩溃。
摆脱神学般的末日预言,让法律追责落到发版公司的资产负债表上,才是遏制技术脱缰最坚固的缰绳。
