Anthropic在2026年7月23日宣布,Claude语音模式的底层模型从轻量级的Haiku扩展到Opus和Sonnet。同时打通Gmail、Slack、Canva等办公应用,新增九种语言的正式支持。
这次更新的关键不是Claude说话变聪明,是语音入口从负责快速问答的工具,开始往能处理复杂任务、直接在应用里执行动作的方向走。响应速度够不够快、权限范围划得清不清楚、执行会不会出错——这些真正决定体验好坏的问题,Anthropic的博客里都没细说。
从"快问快答"到"处理难题"
Claude语音模式2025年上线,一开始只搭载Haiku。这款模型速度快,但能力有限,官方当时的说法是"让对话保持轻快,但不总能深入"。
用户没把它当简单问答工具用。Anthropic承认,不少人拿语音功能处理"真实的业务问题",这正是Haiku的短板。这次换上Opus和Sonnet,官方给这两款模型的定位是"为解决难题设计",能给出更深的分析。
具体能干什么,官方举了两个例子:把一段口头讨论整理成一页纸的提案;或者赶火车时突然晚点,让Claude帮着重新排一遍当天的日程。
模型切换是无缝的。用户能在文字和语音之间来回切,也能在同一对话里从Haiku换到Sonnet或Opus,不用另开一个对话。跟Haiku聊出一个想法的苗头,直接换模型继续往深了聊。
| 模型 | 定位 | 典型场景 |
|---|---|---|
| Haiku | 低延迟问答 | 查信息、下简单指令 |
| Sonnet / Opus | 复杂分析与执行 | 整理提案、重排日程、跨应用操作 |
接入Gmail、Slack、Canva,语音才碰到真活儿
光换模型,只是把语音模式的能力上限抬高。真正让它往"能干活"迈一步的,是这次一并开放的应用权限——Gmail、Slack、Canva都在名单里。语音对话不再只停在生成文本建议,有机会直接在这些工具里落地成动作。
这条路线不新鲜。ChatGPT等产品这两年也在往同一个方向走:语音交互是起点,能替用户在真实工具里执行任务的代理才是终点。Anthropic这次更像是把Claude推上一条已经被验证有需求的路,不是开辟新赛道。
常年在邮件、协作工具、设计软件之间切换的知识工作者,会先感受到方便:开车或走路时口述几句,就能让Claude去改日历、回一条Slack消息,比打字快。企业采购和IT团队则要补一门新功课——语音代理能读写哪些应用、权限怎么授、操作错了怎么审计和撤回,博客里没细说,评估AI办公预算时得自己去问清楚。
现实的限制是,语音操作邮箱和协作工具,误触发的代价比打字对话高。Anthropic没有公开权限边界和撤回机制的细节,企业在开放权限前,最好先拿低风险场景测试一轮。
接下来该盯什么
九种新增正式支持的语言——法语、德语、西班牙语、印地语、印尼语、意大利语、日语、韩语、葡萄牙语——之前一直是测试版,这次转正,说明Anthropic把语音模式当长期产品线在打磨,不是临时功能。
但Opus、Sonnet在语音模式下的延迟、价格、企业可用范围,官方目前一个字没提。延迟决定语音体验流不流畅,价格决定值不值得为语音单独加预算,企业可用范围决定IT部门能不能批。这几项什么时候公布,加上Gmail、Slack、Canva里具体开放了哪些读写权限,是接下来最值得盯的变量。
