5月还在说"敞开用",6月中旬账户就空了。
美国陆军内部邮件显示,陆军首席信息官(CIO)今年5月宣布AI token"不限量",结果不到六周,这个池子就见了底,只能紧急恢复限额。现在的额度保住了,但10月1日之后续不续,官方没给准话。
一个月烧掉一年的量,发生了什么
陆军用的AI平台叫Ask Sage,能调用Gemini、Llama、ChatGPT这些主流大模型,获准处理"受控非密信息",人事分类、采购流程都靠它跑。这不是玩具项目,是实打实的行政基础设施。
具体的账怎么算,DEVCOM邮件里写得清楚:
| 项目 | 数字 |
|---|---|
| 企业年包标称额度 | 1亿token |
| 普通员工每月起分配 | 20万token |
| 用完之后 | 系统自动追加 |
| 池子耗尽时间 | 5月宣布不限量,6月中旬见底 |
| 10月1日后续供 | 未确定 |
更微妙的是,陆军此前一直在催那些用得少的员工"多用起来"。用量本身,一度被当成一种值得表扬的指标。一边是自动追加的额度,一边是鼓励多用的KPI式催促,账户耗尽的速度,自然比谁都想象得快。
谁在为这件事担着风险
匿名接受《连线》采访的陆军员工说,工具并不稳定,有一次模型直接声称完成了某项任务——但其实没做。这类可靠性问题和token超支是两条线,却常被合并成一句"AI好用",直到账单和bug同时找上门。
受影响的不只是烧token的这批人。国防部同期被曝削减了"文职保护卓越中心"的人手,这个中心负责平民伤亡评估,同时又在开发AI工具来加速这类评估。人力收缩和AI工具开发确实同步在发生,但两者能不能互相顶替,现在还没人验证过。
这件事真正牵动的三类人:陆军日常行政和研发人员,要先看token够不够,再决定手头任务排不排得上;依赖Ask Sage跑采购、人事审批的团队,大概率会把非紧急流程往后压一压,等确认额度稳了再推进;而那些原本靠人工审核兜底的岗位,眼下多了一层"AI说完成了,但没人复核"的风险。
这不是陆军一家的毛病
同样的剧本,过去一年在别的地方演过。
| 机构 | 曾经的鼓励 | 后来的转向 |
|---|---|---|
| 陆军 | 5月宣布token不限量,还催低使用率员工多用 | 6月中旬额度耗尽,紧急恢复限额 |
| Meta | 搞过"tokenmaxx"用量排行榜 | 排行榜悄悄下线,Instagram负责人上周讨论给工程师设token上限 |
| Uber | 鼓励工程师放开用AI辅助编码 | 4个月烧光一年额度 |
三家的套路几乎一样:先煽动性地喊"随便用",员工真信了、真用了,公司再回头设限。《左传》说"其兴也勃焉,其亡也忽焉",放在这里未必是"亡",但"忽焉"这两个字很贴切——兴奋来得快,踩刹车也来得突然,中间缺的是一段冷静测算的过程。
这一轮AI企业推广最大的漏洞,不是员工用得太猛,是没人在推广之前把三笔账放在同一张表上看:这个功能到底值多少token、员工产出的东西能不能用、超支了算谁的。陆军把"用量"当成推广成功的标志,却没把"效果"和"预算"绑在一起验收。
接下来最该盯的时间点很明确:10月1日,陆军CIO的token池续不续。如果续了,却没配上新的用量审查机制,这套"先喊后限"的剧本大概率还会再演一遍,换个部门、换家公司而已。对正在考虑给团队上生成式AI大礼包的企业IT决策者来说,这也是一个现成的提醒:签合同前,先问清楚这包token怎么计费、谁来担超支,比问"够不够用"更重要。
