一张AI生成的《Pluribus》彩蛋图,喂给另一个AI代理,17分51秒后吐出一个387个网格、144万三角面的三维模型。打开浏览器,这个模型还能直接转起来看。

整套流程没有新技术。新鲜的是这三段工具——画图、建模代理、网页预览——被作者自己手工串成了一条能复现的小流水线。说明的是三段能力可以拼起来用,不是AI已经能独立完成建模这件事。

几分钟看懂:一张图怎么变成浏览器里能转的模型

从一张图到浏览器预览 ChatGPT Images 2.5 生成彩蛋图 Codex / GPT-6 Astra 建模 17分51秒 .blend 文件 7.2MB 17种材质 .blend URL Viewer 浏览器预览 示例模型:387个网格 · 78.4万顶点 · 144.6万三角形 · Blender 5.1文件

三段各自的事实,压成一张表:

阶段工具输入输出
画图ChatGPT Images 2.5一句prompt:"画一枚《Pluribus》主题的法贝热彩蛋,先研究一下"一张半开蛋壳,里面是剧中角色对峙场景
建模Codex + GPT-6 Astra(high)+ 作者自制的Blender本地技能文件上一步的图片 + prompt:"用你的Blender技能建一个这个彩蛋的模型"17分51秒后生成多个.blend文件
预览.blend URL Viewer(作者自制小工具)GitHub链接或支持CORS的.blend文件地址浏览器内可旋转、看线框,387网格 / 78.4万顶点 / 144.6万三角形 / 17种材质 / 7.2MB

有一点容易被忽略:那个"Blender本地技能文件"不是GPT-6 Astra自带的能力,是作者此前自己写的技能配置,教代理怎么调用Blender命令行。代理会建模,前提是有人先把工具用法喂给它。

谁能直接拿来用,谁还得等等

这条链路的门槛,取决于你要拿它干什么。

使用场景现在能不能用卡在哪
个人做草图级3D原型、社交分享可以试容错高,几十分钟出个能看的模型,成本主要是等待时间
专业3D/游戏团队接入生产管线不建议直接用拓扑质量、修改器兼容性没人验证过,还是要人工重建
打算商用发布或卖周边先别急剧集形象和法贝热经典设计的版权边界都没解决

个人爱好者最该关心的,是这条流水线把"有想法但不会建模"的门槛压低了——写对prompt、配好技能文件,就能拿到一个可交互的三维草稿。专业团队最该关心的,是它目前拿不出可验证的建模质量:拓扑是否合理、比例是否精确,都没有第三方检查过。

耗时和成本这块,作者没有公开token消耗和是否重试过,所以这条流水线跑一次到底多贵、稳不稳定,现在还看不清。

别把可预览当成可生产

浏览器里能转的模型看着挺完整,但这个查看器解决的只是"能看",不是"能用"。它渲染的材质是近似值,没应用的修改器直接省略——你在浏览器里看到的效果,和打开正版Blender渲染出来的,不是同一个东西。

17分51秒这个数字也不该被当成建模效率的通用标准。这次针对的是一枚风格规整、中等复杂度的彩蛋,换成机械结构或者严格比例的工业模型,代理会不会同样顺畅,现在没有失败案例可以参考,也没有成功案例可以对照。

版权这块更实际。这枚彩蛋直接取材《Pluribus》剧集形象和帝俄法贝热珠宝的经典风格,属于个人练手没问题,一旦想商用——卖周边、做手办、上NFT——剧集IP和珠宝设计风格挪用这两层版权都绕不开,最好先找律师看一眼再动手。

接下来最该盯的变量:这条流水线能不能在更复杂的几何体和更严格的拓扑要求下复现同样的成功率。现在手里只有一个成功样本,没有失败案例,判断它是不是稳定能力还早。

真正被打通的,是三段本来各自独立的工具:文生图给了建模一个视觉锚点,代理建模把草图变成结构化的三维资产,浏览器查看器让分享不用装Blender。瓶颈也跟着挪了位置:从"谁会建模",挪到"提示词写得准不准、技能文件配得对不对、模型质量能不能过人工检查"。