Anthropic在2026年7月23日宣布,Claude语音模式的底层模型从轻量级的Haiku扩展到Opus和Sonnet。同时打通Gmail、Slack、Canva等办公应用,新增九种语言的正式支持。

这次更新的关键不是Claude说话变聪明,是语音入口从负责快速问答的工具,开始往能处理复杂任务、直接在应用里执行动作的方向走。响应速度够不够快、权限范围划得清不清楚、执行会不会出错——这些真正决定体验好坏的问题,Anthropic的博客里都没细说。

从"快问快答"到"处理难题"

Claude语音模式2025年上线,一开始只搭载Haiku。这款模型速度快,但能力有限,官方当时的说法是"让对话保持轻快,但不总能深入"。

用户没把它当简单问答工具用。Anthropic承认,不少人拿语音功能处理"真实的业务问题",这正是Haiku的短板。这次换上Opus和Sonnet,官方给这两款模型的定位是"为解决难题设计",能给出更深的分析。

具体能干什么,官方举了两个例子:把一段口头讨论整理成一页纸的提案;或者赶火车时突然晚点,让Claude帮着重新排一遍当天的日程。

模型切换是无缝的。用户能在文字和语音之间来回切,也能在同一对话里从Haiku换到Sonnet或Opus,不用另开一个对话。跟Haiku聊出一个想法的苗头,直接换模型继续往深了聊。

模型定位典型场景
Haiku低延迟问答查信息、下简单指令
Sonnet / Opus复杂分析与执行整理提案、重排日程、跨应用操作
语音模式换了脑子 Haiku 低延迟 · 快问快答 2025年语音模式起点 不擅长深度任务 Sonnet / Opus 复杂分析 · 一页提案 接入Gmail/Slack/Canva 2026年新增语音支持

接入Gmail、Slack、Canva,语音才碰到真活儿

光换模型,只是把语音模式的能力上限抬高。真正让它往"能干活"迈一步的,是这次一并开放的应用权限——Gmail、Slack、Canva都在名单里。语音对话不再只停在生成文本建议,有机会直接在这些工具里落地成动作。

这条路线不新鲜。ChatGPT等产品这两年也在往同一个方向走:语音交互是起点,能替用户在真实工具里执行任务的代理才是终点。Anthropic这次更像是把Claude推上一条已经被验证有需求的路,不是开辟新赛道。

常年在邮件、协作工具、设计软件之间切换的知识工作者,会先感受到方便:开车或走路时口述几句,就能让Claude去改日历、回一条Slack消息,比打字快。企业采购和IT团队则要补一门新功课——语音代理能读写哪些应用、权限怎么授、操作错了怎么审计和撤回,博客里没细说,评估AI办公预算时得自己去问清楚。

现实的限制是,语音操作邮箱和协作工具,误触发的代价比打字对话高。Anthropic没有公开权限边界和撤回机制的细节,企业在开放权限前,最好先拿低风险场景测试一轮。

一句话怎么变成一个动作 语音提问 日程/邮件/ 业务问题 选模型 Haiku 快答 Sonnet/Opus 深答 执行动作 改日程 发Slack/回邮件

接下来该盯什么

九种新增正式支持的语言——法语、德语、西班牙语、印地语、印尼语、意大利语、日语、韩语、葡萄牙语——之前一直是测试版,这次转正,说明Anthropic把语音模式当长期产品线在打磨,不是临时功能。

但Opus、Sonnet在语音模式下的延迟、价格、企业可用范围,官方目前一个字没提。延迟决定语音体验流不流畅,价格决定值不值得为语音单独加预算,企业可用范围决定IT部门能不能批。这几项什么时候公布,加上Gmail、Slack、Canva里具体开放了哪些读写权限,是接下来最值得盯的变量。