一台2022年买来当智能家居仪表盘用的Amazon Fire HD 10平板,最近半年开始无缘无故自己关机,一天两次。日志显示不是死机,是系统主动下的关机指令。这原本是个小众极客的维修笔记,但故事讲到后面变成了一次意外的AI模型横评:作者称自己先后请出Claude、Kimi K3GLM-5.2GLM-5.3四款大模型,花了$266.15,最终用一个2022年就被曝光的漏洞root了自己的平板,把Amazon藏在系统里、握着关机权限的上百个受保护软件包连根拔起。

这篇文章目前只有作者本人的个人主页一个信源,署名、事件细节、乃至发布时间本身都没有第三方渠道能交叉核实——这一点必须放在最前面说清楚,后面所有分析都建立在“姑且采信原文陈述”的前提上。

四笔账单,四种性格

作者给出的花费很具体:Kimi K3花了30小时、621条消息,找到漏洞用了$164.25;GLM-5.2连夜修bug、排除了错误方向,花$21.90;GLM-5.3当天收尾,用的是$80一个月的Z.ai编程订阅首日;Claude的诊断跑在作者本来就付费的Claude Max套餐里,没有单独计价,但最后被自家安全护栏中断,没能完成收尾。四笔加起来正好是$266.15,比平板本身的购入价$114.26贵了一倍多。

四笔账单:谁在真正干活 Kimi K3 找漏洞 $164.25 GLM-5.2 修bug $21.90 GLM-5.3 订阅日 $80.00 平板原价(对照) $114.26 Claude诊断跑在既有订阅内,未单独计价,最终被安全护栏中断

真正烧钱的不是修复,是找到漏洞本身——那三十个小时的试错,占了总花费的六成以上。这也是这类叙事容易被误读的地方:读者很容易记住“AI帮我root了平板”,却忽略了这活儿本质上还是暴力试错加人工盯梢,作者自己也承认自己的贡献是“知道什么时候该催、什么时候该换模型”。

一个漏洞,两年真空期

真正撑起这次root的技术核心,是CVE-2022-38181,Arm Mali内核驱动里的一个use-after-free漏洞。它的生命周期比故事本身更值得琢磨:2022年被GitHub安全实验室报告,同年10月Arm在上游修复,2023年3月被CISA列入已被利用漏洞目录,Amazon却拖到2024年6月才在Fire OS 7.3.2.9里把它堵上。作者的平板停留在更早的7.3.2.6,从没等到这次更新,等于两年时间里一直带着一扇没关的门。

补丁真空期:从曝光到堵上花了近两年 2022 上游修复 2023.03 CISA收录 2024.06 Amazon补丁 作者设备:从未更新

这不是Fire平板独有的问题,是消费电子行业老矛盾的一个具体切片:厂商用bootloader锁死设备、用受保护系统包卡死用户的卸载权限,本意是防篡改,代价是老款、低关注度型号的补丁优先级永远排在后面。2020年的Fire HD 8 Plus早就被人用同一个CVE root过,2021款的HD 10按作者的说法此前没人公开做成过——如果这个说法属实,说明厂商锁得越死的型号,反而越可能变成漏洞的“长尾库存”。

拒绝的Claude,和被说服的Kimi

故事里最耐人寻味的一段,不是谁技术更强,是谁愿意接这个活。作者称自己让Claude回顾几个月前的诊断记录时,被安全护栏直接拦截,理由是“可能涉及网络安全”,换了子代理、换了模型版本都没绕过去,连总结自己此前的合法工作都不行。相比之下,Kimi K3收到“帮我root自己的设备”的请求后,先自问了一遍法律和伦理边界,确认DMCA有越狱豁免条款,才决定动手;GLM-5.2、GLM-5.3则几乎没有犹豫,直接进入执行模式。

拒绝的不是能力,是策略;这笔账,厂商心里都有数。

这不该简单读成“中国模型更强、美国模型更弱”。更准确的说法是:不同厂商对“护栏该有多宽”做了不同的商业选择。Anthropic自己在拦截提示里承认护栏“刻意设置得很宽”,为的是减少误判带来的舆论风险,代价是牺牲一部分正当的安全研究和维权场景。这是一个可以量化取舍、但没有标准答案的产品决策,选边站队没有意义,看清代价才有意义。

  • 提醒.整个事件目前只有作者一方陈述,模型跑分、耗时、对话记录均无第三方复现,读者可以把它当作一个值得追踪的案例,但不宜当作已核实的行业结论。

谁该盯着这件事

如果你手里也有一台还在用旧固件、又迟迟等不到厂商更新的智能设备,这个故事至少提示一件事:老款硬件的安全窗口期,正在被越来越强的agentic编程模型压缩——过去需要专业安全研究员数周才能复现的n-day利用链,现在理论上可以被一个懂得如何“催”模型的普通用户在几天内跑通。对Amazon这类厂商来说,这意味着老设备的补丁义务不能再靠“型号冷门就拖后”蒙混过去。对普通用户,更现实的建议是先确认自己设备的固件版本和厂商补丁记录,而不是急着去复刻这套流程——这篇文章本身的真实性还没有被验证,值得看,不必照做。