在纽约的一间会议室里,Sandbar的CEO没有掏出手机打字,而是把一枚戒指举到嘴边,大拇指按住戒指侧面的触控板,低声说了两句话。松手几秒后,两句标点齐全的完整句子出现在手机备忘录里。

这枚戒指叫Stream,计划今年晚些时候发货,卖点很直白:不用掏手机,也能把话变成文字。过去大半年,AI硬件几乎都在往"更显眼"卷——智能眼镜要装摄像头、要投影;AI别针一度想让胸前一块屏幕取代手机。Stream反着来,它不抢手机的活,只想省掉掏手机、解锁、找App这几步动作。

Stream怎么用,比听写软件、智能眼镜、AI别针少了几步

Stream的硬件很朴素:一枚戒指,内置麦克风、电池、连接手机的蓝牙模块,外加一块触发录音的触控板。按住说话,松开,语音经蓝牙传到手机,模型转写成文字,输入到当前打开的任何App——备忘录、邮件、聊天窗口都可以。

这背后的功劳其实不在戒指,在听写模型这一年确实变强了。WisprFlow这类语音输入软件已经能把口语转成通顺文字,只是偶尔太规矩,随口一句话也要格式化成正式邮件,句末还非加句号不可。Sandbar的演示证明同样的能力搬到一枚戒指上也能跑通,几秒钟的短句转写效果不错。

但这只是一次现场演示。产品还没发货,长句、专业词汇、嘈杂环境下的识别率,还有续航和误触率,目前都没有答案。

触发路径对比:掏手机 vs 按戒指 手机路径 1. 摸兜/包找手机 2. 解锁屏幕 3. 打开App/输入法 4. 开始说话或打字 共4步 戒指路径 1. 按住触控板 2. 低声说完松手 共2步

把Stream和现有的语音输入方式摆在一起看,差距更清楚:

方式触发动作是否离得开手机目前已知的短板
WisprFlow等听写软件解锁手机→打开App→说话不能,软件本身跑在手机上格式过度工整,爱加句号
智能眼镜佩戴后语音或触控唤醒通常仍需连手机外观负担重,摄像头惹隐私争议
AI别针抬手对准、开口说话部分机型试图独立联网操作链条比掏手机还长,多数没能活下来
Stream戒指按住触控板→说话→松开不能,需蓝牙连手机转写未发货,准确率、续航、隐私机制均未公开

四条路径放在一起看,Stream省的步骤最少,但它也是唯一还没交货的一个。

对关注AI硬件的读者和高频文字工作者,分别意味着什么

AI硬件这几年比拼的东西,基本是芯片和模型,其次是外形和续航,交互摩擦往往排在最后——但真正决定一款设备能不能被留在身上的,偏偏是排在最后的那一项。

AI硬件成败的三层 芯片与模型 大家都在卷,最快同质化 外形与传感器 决定造型、续航、佩戴感 交互摩擦 真正决定用不用得下去

关注AI硬件落地、而不是概念炒作的读者,更该盯发货后的独立评测,而不是发布会演示。几秒钟的短句转写,说明不了长句、专业术语和嘈杂环境下的识别率,更测不出续航和误触率——这些恰恰是戒指类设备最容易翻车的地方。

依赖手机和电脑做高频文字沟通的人,比如天天写邮件、发消息、记笔记的知识工作者,可以先算一笔账。如果你已经在用WisprFlow这类软件听写,Stream省下的只是解锁手机、点开App这几秒,语音转文字的准确率不会因为换了个戒指就变好。如果你还没有语音输入的习惯,一枚戒指也替不了这个习惯。

门槛不在模型,在隐私、场景和对手机的依赖

低声说话这件事,在公共场合天然尴尬。地铁上、开放办公室里,未必愿意对着手指头念叨——这是"能用"和"愿意用"的差别,厂商的演示视频从来不会告诉你这个。

Stream也离不开手机。转写要靠蓝牙连手机、再走网络到云端模型,戒指本身不是独立的AI终端。手机没电、没信号,它就是一枚普通的戒指。Sandbar目前也没有公开价格、具体上市日期、订阅方式和隐私处理机制——这些才是产品发货前最该盯的几个变量。

那间会议室里几秒钟的演示,证明的是模型够快,不是产品够好。AI硬件这些年反复往传感器、屏幕、功能上堆,却没几个能被人天天戴出门。Stream赌的是相反的答案:少做一步,才有可能被留下来。

AI硬件最好的样子,是让人忘记它在开机。