Anthropic 旗下的编程助手 Claude Code 在推出短短 6 个月内创造了约 10 亿美元收入,推动自然语言编程席卷行业,甚至引发 Monday.com、Salesforce 和 Adobe 等传统软件服务商股价重挫,带动纳斯达克 100 指数在两天内蒸发约 5000 亿美元市值。
然而,科技作家兼资深开发者 Paul Ford 近日在《纽约时报》撰文给狂热的市场泼下冷水:AI 让人人都能写出看似完备的代码,却也让所有人都能轻易地把别人的工作搞砸。表面上代码产出呈指数级膨胀,实际的工程交付却正在滑向失控边缘。
10 亿美元神话与廉价代码带来的反常繁荣
在 Paul Ford 的对比中,开发门槛的塌陷显而易见。2021 年一个原本需要外包团队花费 25,000 美元的个人建站项目,或者一个需要产品经理、设计师配合 2 名工程师耗时 4 至 6 个月、专业报价 350,000 美元的数据清洗系统,如今依靠每月 200 美元的 Claude 订阅方案,单人在通勤间隙就能搭建出可用原型。

这种门槛归零让资本市场相信传统软件架构行将就木。然而,生成指令与交付工业级软件之间存在着本质鸿沟。代码从来不是单纯的机器指令,它嵌套在企业权责、安全防护和长达数年的持续维护中。当没有系统设计经验的人通过自然语言快速堆叠出功能模块,交付团队面对的往往不是资产,而是一堆外表光鲜却缺乏异常处理的隐形负债。
既然人人都能写代码,反而更能看清为什么许多人根本不该写。
生产力幻觉:主观快了 20%,客观慢了 19%
评估 AI 对软件生产力的真实影响,必须拆开任务结构来看。

微软、埃森哲与财富 100 强企业针对 4,867 名开发者开展的实地实验显示,在基础代码补全场景下,任务完成数增加了 26.08%,其中经验较浅的开发人员采纳度与效率增益尤为突出。这一阶段的 AI 确实充当了高效的语法外挂。
但当场景切入庞大而严谨的工业级系统时,实验得出了相反的结论。研究机构 METR 针对 16 名资深开发者在成熟代码库上的随机对照试验表明,使用 Cursor 和 Claude 等工具不仅没有提速,反而导致任务完成时间实际延长了 19%。
更值得警惕的是开发者身上出现的认知倒错:尽管实际交付被拖慢,受试工程师主观上却坚信自己快了 20%。编写代码时的飞速敲击带来了即时满足感,掩盖了随后在上下文混乱、边界条件缺失中反复排查的隐形成本。
债务转移机制:代码审查正在变成无底洞
AI 没有消灭劳动,它只是把写代码的轻松,转嫁成了审查与调试的沉重包袱。

Stack Overflow 2025 开发者调查显示,66% 的工程师将 AI 给出看似正确但实则错误的回答视作主要痛点,45% 的人明确表示调试此类代码花费的时间远超手写。代码分析平台 CodeRabbit 对 470 个开源拉取请求(PR)的追踪更证明了这点:由 AI 共同编写的 PR,其包含的潜在问题数达到了纯人类编写的 1.7 倍。
代码膨胀不仅冲击了质量底线,更在拖垮资深技术骨干。开源生态监测显示,GitHub Copilot 普及后,核心维护者承担的代码审查量上升了 6.5%,而他们自身的原创代码产出反而下滑了 19%。Google DORA 2025 报告同样给出警告,AI 采用率的攀升在推高代码吞吐量的同时,伴随而来的交付不稳定性也在同步上升。
- 风险.若企业仍以提交代码行数或拉取请求数量作为开发效能指标,AI 工具将诱发大规模的低质代码灌水,最终令团队在后期的回归测试与线上故障排查中瘫痪。
就业市场割裂与新工程阶梯的成型
在招聘市场上,这种工程分化直接演变成了残酷的断层。

GitHub 与 LinkedIn 的调研显示,引入 Copilot 的企业在宏观招聘概率上增加了 3% 至 5%,短期内主要由配置辅助工具的基础岗位拉动。然而劳动经济学研究机构 IZA 的 2026 年统计揭示了更为长期的趋势:大模型普及后,初级软件工程师的岗位需求相对资深岗位下滑了 14% 至 15%。
过去初级开发者依靠修补缺陷、编写测试来熟悉架构和培养直觉的学徒路径正在瓦解。企业不再为没有判断力的键盘打字员买单,但如果新人跳过了基础编码的磨砺,行业未来将很难培养出能对复杂系统做出拍板决策的架构师。
- 建议.资深工程师的不可替代性不再是手写代码的速度,而是向 AI 精确定义领域上下文、设计容错边界并对系统安全负最终责任的能力。
代码已经从稀缺资产彻底贬值为供应过剩的工业原材料。狂欢过后,软件工程的重心正在全面回摆:决定一个项目生死存亡的,依然是人类对于业务意图的深刻理解与协同判断。
