软件工程师 Kira Howe 在8月8日发博客吐槽自己被agentic编程工具ONA折磨了大半天:桌面端登录始终失败,换到网页端又经过多次跳转才勉强进去。好不容易接入一个Linear项目,以为终于能让Agent自动推进待办列表,结果它反反复复去抓取todo,始终没能真正开始干活,把她近20美元的算力额度全部烧光,最后一件事也没干成。她的结论很干脆:这整个agentic AI工具生态,基本都是营销撑起来的“蒸汽件”。
这话听起来像又一次常见的个人体验吐槽。但真正让人皱眉的不是登录失败本身,而是另一件事——她吐槽的这款产品,两个月前刚被OpenAI宣布收购,准备把它并入Codex的核心基础设施。
20美元,买了一次登录和一次空转
还原一下这次体验的时间轴:桌面客户端登录不了,转投网页端后经历多次跳转才登入成功。接入项目后,Agent没有去做她真正想要的“梳理需求—排期—开发—测试—部署”,而是反复尝试从Linear抓取待办事项,连“挑一个开始做”这一步都没跨过去。20美元的计算额度就这样耗尽,进度为零。
她的判断也很直接:这些工具背后的工程师大概拿着无限token,却没有一套系统的可用性测试或“自己吃自己的狗粮”流程,产品只在最简单的happy path上跑得通。
她吐槽的不是无名新创,而是刚被OpenAI收下的团队
这才是最容易被漏掉的信息。ONA的前身是Gitpod,已经运营了6年,拥有约200万开发者用户。2025年9月改名重塑为Ona之后,企业年化经常性收入(ARR)在此前一季度同比翻了两番,还拿下一份接近八位数金额的合同。2026年6月11日,OpenAI宣布已达成协议收购Ona,计划把它的安全云端执行与编排技术并入Codex生态。截至8月9日,这笔交易仍在等待常规成交条件和监管批准,尚未close。
也就是说,Kira口中“连登录都做不到”的产品,正是即将成为OpenAI官方agentic编程基础设施一部分的团队。这不是一家籍籍无名的创业公司在裸奔,而是一家被资本市场和巨头收购信任票投过的公司,在最基础的登录环节掉了链子。
算力计费:Agent空转,账单照样滚
Ona现在的定价是Core计划每月起价20美元,最多支持100名成员且不按席位收费,使用量以“Ona Compute Units(OCU)”计量,月度额度在80到2200 OCU之间,超出后按每10美元40 OCU追加。官方给的参照是:1 OCU大致相当于在一台4vCPU/16GB的虚拟机上跑一小时,但Agent真实任务消耗的额度差异很大。
问题在这套计费的结构里:它按算力和运行时间收钱,不是按产出收钱。Agent反复失败地去抓取Linear todo列表,本质上也是在占用虚拟机运行时间——这部分同样计入账单。厂商在这种机制下,没有天然的经济动力去在意“Agent空转但什么都没干成”这件事,因为无论有没有进展,计费都在照常发生。
- 风险.按算力计费的模式,让厂商对Agent低效重试缺乏改进的紧迫感——用户为“无效尝试”买单,厂商照样收钱。
值得一提的是,2025年9月的发布材料曾宣传过免费入门层级,但目前公开定价页只保留Core和Enterprise两档付费方案。免费层级消失,这是“营销讲得比产品能兑现的多”的一处具体证据。
这不是Ona一个人的问题
把视野拉宽一点,Devin、Factory Droids、Codex、GitHub Copilot coding agent这批玩家,面对的都是同一类批评:演示强、真实场景弱,成本偏高,需要大量人工复核,环境和权限配置的摩擦不小。目前也没有可信的公开证据表明Ona在同等条件下全面优于这几家。SWE-bench、Terminal-Bench这类跑分数字看着漂亮,但和真实工程工作流之间的落差,行业内早已心知肚明。
写代码这件事的成本,已经被LLM推理压得很低——现在人人都能起一个vibe coding的项目。软件工程真正难的部分从来不是写代码,而是需求梳理、认证集成、异步任务调度、QA这些琐碎又麻烦的环节。这恰恰是这些公司在“无限token+零系统QA”的环境里最没有动力去打磨的地方,因为演示视频不需要它们。
故事讲得比登录页跑得快,这大概是这个赛道最诚实的注脚。
- 结论.ONA的产品理念本身没问题——用Agent加可复现云环境自动化开发流程,这是一个值得投入的方向;问题出在执行和打磨,不是方向错了。
资本和巨头已经为“agentic coding有效”投出了信任票:一笔待close的收购,一份翻两番的ARR,一份接近八位数的合同。但真实体验依然卡在最基础的登录环节。这中间的落差,与其说是模型能力不够,更像是产品工程和QA系统性缺失——写代码的成本已经塌陷,交付一套真正好用的端到端产品,难度反而没降。对开发者来说,选型时别再只看厂商自己给的跑分,拿自己团队里二三十个真实任务跑一遍,比任何演示视频都可信。
