一家几个月前刚拿到7亿美元A轮融资的AI初创公司,第一次公开产品的方式,是发一段只展示了部分流程的演示视频,外加一句"我们比GPT-5.5和Opus 4.8更快更便宜"的自我评价。这就是Hark在8月5日交出的答卷——浏览器操作代理Hark Handoff。它能在没有官方API的网站上模拟点击和输入,完成订餐、订票、购物、订位这类日常任务,目前开放等候名单,计划夏末正式上线。问题是,这份答卷里,能核实的部分几乎为零。

无API网站上的"点击机器人"

Handoff的技术路径不复杂:模型读取网页的视觉信息和页面结构,判断该点哪个按钮、该往哪个输入框打字。Hark公开演示中,CEO Brett Adcock演示了一个用模糊指令(比如"某种花店推荐")定制花束的场景,代理据此在电商网站上完成下单。公司同时点名Target、Walmart、OpenTable、LinkedIn这几个没有开放官方API的平台,作为Handoff能"啃下来"的目标。

这套思路本身并不新鲜。Google、OpenAI、Anthropic都有自己的计算机使用代理,VC投的初创公司里,Browser Use、Polar、Strawberry、Aside早就在做同类产品。Hark想在拥挤赛道里立住脚,靠的是两个卖点:更快更便宜,以及一句更抽象的技术主张——"预测下一个动作,而不是预测下一个token"。

7亿美元的第一份公开成绩单

这两个卖点目前都停留在公司自述层面。Hark没有公布任何基准测试、延迟数据或定价信息来支撑"比GPT-5.5、Opus 4.8更快更便宜"这句话;"预测动作而非token"这个说法,也没有配套的技术论文或架构细节,外界无法判断它跟Anthropic的Computer Use、OpenAI的Operator走的是不是同一条路,只是换了个说法。

这才是这条新闻真正的看点:它不是又一个浏览器代理产品发布,而是一家融资规模和公开产品完全不成比例的公司,第一次把叙事拿出来给市场检验。今年5月那轮7亿美元A轮融资本身就很罕见——Hark当时几乎没有对外展示过任何产品,只以"秘密的通用AI界面"这个说法拿到了钱。Handoff是外界第一次能拿真实产品去对照这笔投资是否合理。

融资规模 vs 公开证据 7亿 美元A轮融资 2026年5月 0 可验证的 基准测试数据 部分 演示视频 只展示了流程片段

"更快更便宜"经不起细看

TechCrunch原文的记者在报道里其实已经点出了漏洞:演示视频只展示了部分流程,"我们无法真正评估其有效性"。这句话值得多说一句——它意味着连亲眼看过演示的记者,都没能确认代理是否真的完成了任务,还是只是完成了任务里最好看的那一段。

"比GPT-5.5和Opus 4.8更快更便宜"这类对比,在AI创业公司的发布通稿里是标配句式,几乎每家做agent的公司都会讲一遍。没有第三方评测机构复现过这类结果的情况下,这句话的可信度和它带来的营销效果不成正比。

融资先讲故事,产品该讲证据,Hark目前只做到了前一半。
  • 风险.在Target、Walmart这类无API网站上做自动化操作,本身可能触碰平台服务条款,也容易被反爬虫机制拦截,这一层商业和技术风险,Hark目前完全没有公开说明。

拥挤赛道里,谁在用融资规模代替性能证据

Google、OpenAI、Anthropic三家大厂已经把计算机使用代理做成标准功能,初创公司想突围,理论上只有两条路:技术上真的更快更准,或者价格上真的更便宜。Hark选择同时喊出这两条,但目前只给了口号,没给数字。

这不只是Hark一家的问题。浏览器代理这个赛道这两年挤满了拿到融资的初创公司,几乎每一家的发布通稿都长得差不多——宣称能操作无API网站,宣称比对手快,宣称成本更低。融资规模正在变得比产品能力更容易被报道,这本身就是一个值得警惕的信号:读者和投资人看到的"进展",越来越多是叙事层面的进展,而不是可复现的技术进展。

对普通用户来说,现在还不是把订餐订票这类任务交给Handoff的时候——等候名单开放不代表产品成熟,夏末正式发布时是否有真实成功率、延迟数据可查,才是判断它是不是"能用"的第一道门槛。对同赛道的创业者和投资人来说,更该盯住的是:Hark这7亿美元砸出来的,到底是一套真正有优势的架构,还是又一份包装精良的融资故事。