Netlify在自家博客里做了一个朴素的实验:把“做一个社区咖啡店的一页网站,不要CMS”这句话原样丢给11个AI模型,用内部评测工具AXIS打分、记录每次生成消耗的credit。结果摆出来,最贵的Claude Opus 5平均一次要花519个credit,最便宜的DeepSeek V4 Flash只要2.4个,相差超过200倍。“哪个模型更强”每天都被讨论,但把成本摊开写成一张表,是行业里少见的坦白。
这次实验发生在Netlify刚宣布联合OpenRouter、把Agent Runners的模型选择从三家闭源(Claude Agent、OpenAI Codex、Gemini CLI)扩展到Kimi K3、GLM 5.2、DeepSeek V4等开源模型的时间点上。选择变多了,账也变复杂了:一个静态页面到底该为它选贵的还是便宜的模型?这份实测数据,比“开源模型崛起”这类口号有用得多。
519比2.4:同一句话,11份报价单
按均值排序,Claude Opus 5(519)、Claude Sonnet 5(143)、GPT 5.6 Sol低算力模式(141)、Gemini 3.6 Flash(103)、Kimi K3(102)、Gemini 3.1 Pro(53)、GPT 5.6 Terra(39)、DeepSeek V4 Pro(37)、GLM 5.2(27)、Kimi K2.7 Code(19)、DeepSeek V4 Flash(2.4),几乎是一条平滑下坡的曲线,直到最后一步突然跌到接近于零。
更值得留意的是Opus自己的波动:三次跑分里有一次飙到1055个credit,是另外两次(249、253)的四倍多。这说明选了同一个模型,不代表每次账单都一样,预算规划里得留出弹性,而不是拿一次跑分当承诺价。另外GPT 5.6 Sol是平台默认以“低算力”模式跑的,这是Netlify给出的省钱配置,不完全等于这个模型本身的真实上限,拿它和别的模型直接比较时得记住这层前提。
换算成美元,便宜未必划算
Netlify的credit和美元有固定换算:180个credit等于1美元,AI Gateway和Agent Runners共用这一套计价。按这个比例算,Opus均值519credit约等于2.88美元,那次1055credit的异常跑分约合5.86美元;而DeepSeek V4 Flash均值2.4credit,大概只要1.3美分。免费版每月送300个credit,Personal版9美元买1000个,Pro版20美元买3000个,更高档位33到126美元对应5000到20000个——这些数字摊开看,选型的差距不是感觉上的差距,是真金白银的差距。
选型的差距,从来不只是审美差距。
但便宜到极致的模型也有代价。文中提到DeepSeek V4 Flash虽然价格几乎可以忽略,生成效果却“参差不齐”;GPT 5.6 Terra均值39个credit,被文章标为性价比更均衡的折中选项。
- 风险.省下的credit,如果换来的是漏功能或要返工的页面,省下的钱不够抵后续修复的人工成本。
博客说“合作已达成”,文档还没跟上
Netlify博客里写得很明确:刚刚和OpenRouter达成合作,OpenCode成为新的agent选项。但把这个说法拿去对照docs.netlify.com上的现状,会发现AI Gateway页面目前仍只列出OpenAI、Anthropic、Google三家,Agent Runners的官方文档也只列Claude Code、OpenAI Codex、Google Gemini三个agent,OpenRouter和OpenCode都还没出现在正式记录里。
这不代表功能是假的,更像是博客发布的节奏跑在了文档更新前面,不少SaaS平台都有这个习惯。但对准备把生产项目接到新agent上的开发者来说,这个时间差意味着现在动手接入,可能会撞上还没写清楚的边界条件,提前和支持团队确认一下比直接上线更省事。
这次公开的完整数据,只覆盖“建一个静态咖啡店页面”这个最简单的场景。待办列表要接数据库、AI食谱要调AI Gateway,这两类更复杂场景里模型的成本排名会不会变,Netlify还没给出后续结果,现在就断言哪个模型“性价比最高”还早。
