OpenAI在9月8日更新了ChatGPT的图像生成能力,新一代模型叫ChatGPT Images 2.5,配套推出一个叫Sketch的新玩法:在手机App里对着聊天框输入@Sketch,手指画个粗糙草图,配一句文字描述,AI就把涂鸦变成一张细节丰满的图。听起来像"废话变大片"的魔法,但翻遍官方说明会发现,这功能真正的边界——只能在哪用、额度怎么算、画得准不准——官方几乎没主动说清楚。

这些边界恰恰是决定它对谁有用的关键。Sketch的价值不在"精确复刻",而是把创作门槛压到很低;它和Adobe Firefly那类靠滑块控制构图的专业工具,走的是两条完全不同的路。普通用户拿它当好玩的入口没问题,想靠它做严谨设计,大概率会踩坑。

手机先享,桌面缺席

Images 2.5作为底层模型,覆盖了ChatGPT、ChatGPT Work、Codex用户,桌面、手机、网页端都能用。但Sketch这个具体功能,目前官方文档只写明支持手机App,桌面和网页端暂时没有入口——这意味着习惯在电脑上用ChatGPT画图改图的用户,短期内摸不到这个新玩具。

官方给出的另一个亮点是延迟降低最多50%,比上一代Images 2.0快不少。但这个数字来自OpenAI自己的说法,目前没看到独立测评佐证,能不能在真实使用中稳定复现,还得打个问号。

免费额度够画几张

OpenAI没有为Sketch单独定价,用量直接计入各订阅层级现有的图像生成额度。免费用户的限额本来就更紧,用Sketch多画几张,很容易撞到上限。

企业侧的规则更细:部分Business、Enterprise、Edu客户走弹性计费,超出包含额度后,单次图像生成大约消耗5个credit;Edu用户每24小时有3次免费生成额度。新增的模板功能(海报、周边、传单、logo)目前也还没支持Work模式,团队协作场景暂时用不上。

Sketch背后的三个数字 50% 官方自称延迟降幅 (无第三方验证) 5 Credit/次 企业超额度后单次消耗 3次/24h Edu用户免费额度 超出后同样计费

API也换了一套模型

除了ChatGPT里的消费级入口,OpenAI同步上线两款API模型:gpt-image-2.5-flare主打默认速度和高吞吐,gpt-image-2.5-sunburst主打高精度编辑但更耗时。两者的token定价完全一致,开发者选哪个只看场景,不用纠结成本。

项目价格(每百万token)
图像输入8美元
缓存图像输入2美元
图像输出30美元
文本输入5美元
缓存文本输入1.25美元

生成的图像依旧带C2PA元数据标记和隐形水印,这套安全机制没有变化。


手画未必手到

草图引导生成不是新鲜事。此前用户想用草图控制AI出图,通常得先在Adobe Firefly或Midjourney里外部画好,再上传当参考图。OpenAI这次把画布直接嵌进聊天框,试图把"画图—描述—生成—对话式迭代"压缩成一个闭环,这是对之前DALL-E集成和Images 2.0的延续升级。

问题是,低门槛不等于高精度。检索到的用户反馈显示,Sketch经常能抓住草图的大致主题,却丢了精确的位置、比例和姿态关系——生成结果好看,但和原本画的对不上号。多轮对话编辑时还有"指令漂移"的毛病:改一个局部细节,可能顺带把不相关的颜色或构图也带跑了,这跟官方宣传的"多轮一致性提升"有点对不上。

好看不等于画得对,这是Sketch最容易被忽略的潜台词。

横向看,Adobe Firefly靠结构参考滑块提供更精确的构图控制,Midjourney把草图当创意发散的参考而非精确复刻,Google Gemini能接收草图做编辑但没有原生嵌入对话的画布模式。ChatGPT Sketch的差异化不是"最精确",而是"最顺手"。

门槛 vs 精度:两种草图工作流 ChatGPT Sketch 画布内置,随手就画 对话式多轮迭代 无需外部工具 草图忠实度一般 暂限移动端 Adobe Firefly 结构参考滑块 精确构图控制 适合专业设计流程 需先画好再上传 学习成本更高
  • 结论.Sketch真正解决的是"零基础也能表达构图想法",而不是"精确还原设计稿"。
  • 风险.企业超额度按credit计费,重度使用者的实际成本可能比想象中更快累积。

对普通手机用户来说,Sketch是个降低门槛的好玩具,随手一画就能出图,适合社交分享和灵感发散。真要做产品海报、精确排版这类专业活,Firefly的滑块式控制仍然更可靠。接下来值得盯的是:桌面端何时补上Sketch入口、模板功能何时覆盖Work模式,以及"延迟降低50%"这个官方数字有没有独立测评来验证。