在纽约的一间会议室里,Sandbar的CEO没有掏出手机打字,而是把一枚戒指举到嘴边,大拇指按住戒指侧面的触控板,低声说了两句话。松手几秒后,两句标点齐全的完整句子出现在手机备忘录里。
这枚戒指叫Stream,计划今年晚些时候发货,卖点很直白:不用掏手机,也能把话变成文字。过去大半年,AI硬件几乎都在往"更显眼"卷——智能眼镜要装摄像头、要投影;AI别针一度想让胸前一块屏幕取代手机。Stream反着来,它不抢手机的活,只想省掉掏手机、解锁、找App这几步动作。
Stream怎么用,比听写软件、智能眼镜、AI别针少了几步
Stream的硬件很朴素:一枚戒指,内置麦克风、电池、连接手机的蓝牙模块,外加一块触发录音的触控板。按住说话,松开,语音经蓝牙传到手机,模型转写成文字,输入到当前打开的任何App——备忘录、邮件、聊天窗口都可以。
这背后的功劳其实不在戒指,在听写模型这一年确实变强了。WisprFlow这类语音输入软件已经能把口语转成通顺文字,只是偶尔太规矩,随口一句话也要格式化成正式邮件,句末还非加句号不可。Sandbar的演示证明同样的能力搬到一枚戒指上也能跑通,几秒钟的短句转写效果不错。
但这只是一次现场演示。产品还没发货,长句、专业词汇、嘈杂环境下的识别率,还有续航和误触率,目前都没有答案。
把Stream和现有的语音输入方式摆在一起看,差距更清楚:
| 方式 | 触发动作 | 是否离得开手机 | 目前已知的短板 |
|---|---|---|---|
| WisprFlow等听写软件 | 解锁手机→打开App→说话 | 不能,软件本身跑在手机上 | 格式过度工整,爱加句号 |
| 智能眼镜 | 佩戴后语音或触控唤醒 | 通常仍需连手机 | 外观负担重,摄像头惹隐私争议 |
| AI别针 | 抬手对准、开口说话 | 部分机型试图独立联网 | 操作链条比掏手机还长,多数没能活下来 |
| Stream戒指 | 按住触控板→说话→松开 | 不能,需蓝牙连手机转写 | 未发货,准确率、续航、隐私机制均未公开 |
四条路径放在一起看,Stream省的步骤最少,但它也是唯一还没交货的一个。
对关注AI硬件的读者和高频文字工作者,分别意味着什么
AI硬件这几年比拼的东西,基本是芯片和模型,其次是外形和续航,交互摩擦往往排在最后——但真正决定一款设备能不能被留在身上的,偏偏是排在最后的那一项。
关注AI硬件落地、而不是概念炒作的读者,更该盯发货后的独立评测,而不是发布会演示。几秒钟的短句转写,说明不了长句、专业术语和嘈杂环境下的识别率,更测不出续航和误触率——这些恰恰是戒指类设备最容易翻车的地方。
依赖手机和电脑做高频文字沟通的人,比如天天写邮件、发消息、记笔记的知识工作者,可以先算一笔账。如果你已经在用WisprFlow这类软件听写,Stream省下的只是解锁手机、点开App这几秒,语音转文字的准确率不会因为换了个戒指就变好。如果你还没有语音输入的习惯,一枚戒指也替不了这个习惯。
门槛不在模型,在隐私、场景和对手机的依赖
低声说话这件事,在公共场合天然尴尬。地铁上、开放办公室里,未必愿意对着手指头念叨——这是"能用"和"愿意用"的差别,厂商的演示视频从来不会告诉你这个。
Stream也离不开手机。转写要靠蓝牙连手机、再走网络到云端模型,戒指本身不是独立的AI终端。手机没电、没信号,它就是一枚普通的戒指。Sandbar目前也没有公开价格、具体上市日期、订阅方式和隐私处理机制——这些才是产品发货前最该盯的几个变量。
那间会议室里几秒钟的演示,证明的是模型够快,不是产品够好。AI硬件这些年反复往传感器、屏幕、功能上堆,却没几个能被人天天戴出门。Stream赌的是相反的答案:少做一步,才有可能被留下来。
AI硬件最好的样子,是让人忘记它在开机。
