Simon Willison在8月4日更新了他维护的开源插件llm-anthropic,版本号跳到0.26。changelog里写着插件已经支持三款新模型——claude-fable-5、claude-sonnet-5、claude-opus-5。这本该是一条平淡无奇的开发者工具更新,但去Anthropic官网和文档站搜这三个名字,什么都翻不到。插件本身没问题,测试全过、依赖版本写得清清楚楚,问题在于:一份第三方插件的changelog,好像比Anthropic自己的官宣跑得还快。

一份技术过硬的更新

这次升级要求llm>=0.32anthropic>=0.96.0python>=3.10,跟旧版LLM不兼容,得先升级主工具才能装上插件。项目走完了五项测试矩阵和PyPI发布流程,CI全绿。这部分是可以独立核实的事实,跟模型名字是否属实是两码事。

真正的功能变化集中在两块。一是新增了服务器端工具WebSearch、WebFetch、CodeExecution、AnthropicMCP,通过LLM的-T接口调用,原来那套-o web_search*参数被砍掉了。二是推理、工具调用、工具结果全部改成typed events流式输出,CLI默认把推理过程扔到标准错误流,想关掉用-R/--hide-reasoning

0.25 → 0.26 参数变化 旧版本 0.25 thinking_budget thinking_display thinking_adaptive -o web_search* 0.26 中已移除 新版本 0.26 thinking / thinking_effort -T WebSearch -T WebFetch / CodeExecution -T AnthropicMCP typed events 流式输出

扩展思考(extended thinking)也被简化成两个参数:thinkingthinking_effort,取值从lowmax分五档。三款新模型里,Sonnet 5和Opus 5可以用-o thinking 0关掉思考,Fable 5是唯一一个不能关的——它始终在思考。这个细节挺反常,如果Fable真的存在,它大概率不是简单的轻量版模型,更像是一个专门被设计成"必须推理"的档位,跟历史上haiku/sonnet/opus按算力分层的逻辑不太一样。

官网查不到的三个名字

这才是这次更新最值得琢磨的地方。Anthropic官网和文档站(anthropic.com、docs.anthropic.com)检索不到claude-fable-5、claude-sonnet-5、claude-opus-5的任何公告或说明页面。唯一沾边的线索,是Anthropic对齐研究站点上一篇提到"虚构的Claude 5发布场景"的文章——但那明确标注是研究实验的一部分,不是产品公告。

插件已经把参数写死,官网却还没这几个名字。

两种解释都说得通,但都只是推测。一种可能是Anthropic通过邀请制渠道给了部分开发者(包括插件维护者)早期访问权限,公开文档还没跟上;另一种可能是这几个名字本身是内部代号或过渡命名,后续会调整。第三种更朴素的解释是检索窗口有延迟,官方页面可能就在路上。三种解释目前都缺证据坐实。

  • 风险.如果这几个模型是私有预览版接口,普通开发者装上插件调用时大概率会直接报错或鉴权失败,这一点changelog里没提。

从行业惯例看,Simon Willison长期跟踪主流大模型API变化,他的插件更新历史上确实经常跑在媒体报道前面。这给了这次changelog一定的可信度背书,但背书不等于确认——插件能准确复现API的参数结构,不代表这个API已经对外公开。

谁该现在升级,谁该再等等

对已经在用llm-anthropic旧版本的开发者,最实际的问题是兼容性。如果生产环境里还依赖thinking_budgetthinking_displaythinking_adaptive这几个被砍掉的参数,升级到0.26会直接断。官方给出的过渡方案是临时锁定安装llm-anthropic==0.25,先别动。

  • 建议.构建在LLM之上做agent或工具链的开发者,可以趁这次升级顺手把旧的-o web_search*调用迁到-T接口,typed events架构下工具调用和结果的处理逻辑更规整,早迁移比临时补丁便宜。

至于那三个模型名字是否属实,现在下结论还早。真正值得盯的,是Anthropic会不会补一份官方公告,把fable-5的定位说清楚——它如果真的存在且无法关闭思考,那大概率不是面向普通对话场景的模型。在那之前,这份changelog里最扎实的部分,反而是它没吹的那些:测试通过、依赖锁定、参数改造,这些才是眼下能确认的事实。