前端开发工具库 htmx 的创作者、蒙大拿州立大学计算机系教师 Carson Gross 于 2026 年 2 月 27 日发表长文《Yes, and...》,对当下蔓延整个技术圈的职业恐慌给出了明确裁决:AI 时代依然需要程序员,但直接用 AI 生成代码的初学者正在亲手毁掉自己的职业前景。在 Gross 看来,软件工程的底层价值始终只有两件事——运用计算机解决问题,以及在解决过程中控制系统的复杂度。一旦新人跳过亲手书写代码的泥泞训练,代码阅读能力与技术直觉就会被连根拔起,最终掉入代码无法掌控、系统肆意膨胀的魔法师学徒陷阱。
这场针对生成式编程的警示绝非资深技术人的怀旧感伤。随着智能编程助手全面渗透工程一线,行业长期存在一种认知落差,不少技术团队与学习者误以为自然语言提示词是下一代高级编程语言,以为跳过语法细节能带来知识掌握与效率的跃升。然而,近期密集的学术实证与软件工程理论正在无情拆穿这一神话。
htmx 创作者发声:编译器消除复杂度,大模型制造技术债
不少工程师习惯将从手写代码转向 Prompt 提示词生成,类比为计算机历史上从汇编语言跃升至高级语言。Gross 在文章中明确反驳了这种观点。高级语言与汇编之间存在完全确定性的编译映射,给定一段循环或条件判断分支,底层的汇编指令分布高度可预期;高级语言借此剔除了大量偶发复杂度,只留下业务所需的必要复杂度。

大语言模型则是纯粹的概率生成工具。在缺乏精确约束的情况下,AI 生成的方案往往偏好走捷径、选择不恰当的技术路径,从而在代码库中悄然塞入巨大的偶发复杂度。
如果你无法阅读代码,你就无法控制它,整个系统终将走向崩溃。
为了防范这种失控,Gross 建议将 AI 定位为答疑解惑的助教(TA)而非越俎代庖的代码生成器,并公开了一份配套的 AGENTS.md 配置文件,强制限制编码智能体直接给出最终代码。
Anthropic 实验测出 17% 理解落差:调试能力最先衰退
教育者的担忧很快得到了认知科学维度的量化验证。Anthropic 研究团队的 Judy Hanwen Shen 与 Alex Tamkin 于 2026 年 1 月 28 日在 arXiv(2601.20245)发布、并在 1 月 29 日正式公布了一项针对编程技能形成的随机对照实验。

该研究选取了 52 名熟悉 Python 语法但不了解异步库 Trio 的初级软件工程师。受试者被随机分为两组完成相同编程任务:一组允许借助 AI 工具,另一组仅能查阅传统技术文档。
随后的独立测试结果令人警醒。在脱离工具的概念理解与独立编程测试中,无 AI 辅助组平均得分达到 67%,而 AI 辅助组受试者的平均得分仅有 50%,整整落后 17 个百分点(Cohen's d = 0.738;p = 0.01)。
更值得行业警惕的是过程效率与细分能力上的发现。测试数据显示,AI 辅助组在最初完成任务时仅快了约 2 分钟,且这一提速在统计学上并不显著。在所有细分能力评估中,AI 组表现最差的维度正是调试能力。
当代码并非工程师一行行敲击构建时,其大脑并未建立起系统的执行心智模型。表面上顺畅交付的代码,是以未来排查缺陷能力的断崖式下跌为代价换取的。
METR 揭开效率倒挂:感觉快了 20% 实际慢了 19%
不仅初学者在技能形成上面临阻碍,即便对行业老手而言,AI 工具带来的提速感也掺杂着严重的认知泡沫。评估机构 METR 于 2025 年 7 月 10 日发布的论文(arXiv:2507.09089)给出了极具戏剧性的度量。

METR 团队对 16 名经验丰富的开发者在成熟开源仓库中完成的 246 个真实开发任务进行了严格对照。在配备 Cursor 以及 Claude 3.5、Claude 3.7 Sonnet 等主流工具时,受试者在任务前普遍预测 AI 能让自己提速 24%,任务完成后主观上也感觉效率提升了 20%。但实际测量显示,使用 AI 辅助的整体任务用时反而延长了 19%。
开发者感受到的快,大多来自键盘敲击减少与代码瞬间铺满屏幕的即时爽感;实测中的慢,则隐藏在审阅低质补全、排查偶发逻辑冲突与上下文反复纠偏的隐性心智摩擦中。
尽管 METR 在 2026 年 2 月 24 日发布随访更新,指出后续优化测量中资深开发者耗时缩短 18%、新开发者耗时缩短 4%,但官方同时审慎指出,由于置信区间跨过 0、存在样本选择效应与时间测量误差,该数据依然不可靠,无法作为 AI 提速的确定性依据。
- 风险.若团队单纯追求交付行数而放任全自动代码生成,短期内堆积的偶发复杂度将在后续版本迭代与故障排查中转化为高昂的隐性技术债。
从托管生成转向概念助教:守住工程师的核心壁垒
实证研究并非全盘否定 AI 在工程领域的应用价值,而是指明了交互方式的界限。Anthropic 的质性研究指出,那些主要向 AI 寻求概念解释与逻辑推导的开发者,并未出现明显的技能损伤;真正的技能退化集中在将代码编写直接托管给智能体的群体中。

这也正是 Gross 公开 AGENTS.md 配置的核心意图:必须在研发工具层面建立护栏,将 AI 从代替思考的生成机器拉回到辅助成长的助教定位。新一代程序员若想穿透周期波动,应当把精力投注在无法被概率模型轻易取代的稀缺维度:
第一,深度代码阅读能力。在海量概率代码充斥代码库的未来,辨别哪些实现走捷径、哪些模式埋下性能陷阱,比写出一串常见算法更为紧要。
第二,复杂系统架构能力。系统组织与复杂度治理历来脱胎于对小型模块构建的切身体会。缺少底层书写的肌肉记忆,架构设计往往沦为空中楼阁。
第三,业务理解与沟通表达。无论工具如何更迭,软件的核心始终是映射并解决真实世界的业务问题。
- 建议.新入行的工程师应在日常开发中有意识设立防护隔离,强制自己手写核心业务逻辑;企业管理层也需给予初级员工必要的手写探索空间,切勿为了短期表面吞吐量切断工程人才的代际成长路径。
