生图最烦的不是画不好,是改——让它把杯子换个颜色,回来整张图都变了。

Images 2.5 就修复了这件事。想立刻试,在 ChatGPT 输入框打 :Sketch 弹出手绘板,画个草图配一句风格描述,它照你的构图出成品。

开始之前插一句

GPT Images 2.5 发布后,我会陆续把这几天测出来的内容整理到了公众号,包括改图、人物一致性、文字生成、提示词和一些实际玩法,推特篇幅有限,很多测试过程没法全部展开。

下面继续聊 GPT-2GPT-Image 2.5

变的不是更好看,是终于能改了

9 月 8 日发布的这一版,官方讲了三件事:更快、更真、改得准。前两件是常规升级,第三件才是这版真正换掉的东西。

以前的生图是抽卡。你说”把左边那把椅子挪开”,它给你一张构图全变的新图;改到第三轮,人脸开始糊、光影开始飘,只能推倒重来。

2.5 官方原话是两条:只改你让它改的地方,其余细节保持不动;以及在长对话里多轮编辑不掉质量,每次改动叠在之前的成果上,而不是从头再生成一遍。

画质确实升了,上面这组对比一眼能看出来。但这不是这次真正值钱的地方。

一个日本用户的总结比官方说得清楚:2.0 是”会把图画好的 AI”,2.5 是”能守住同一张图、反复改到完成的 AI”。

这句区别值多少钱,取决于你拿它干什么。只是发图玩,2.0 够用;要出一版能交出去的东西,”能返工”这一条比”更好看”重要得多。

画个草图,它照着出图

这是这次最该先试的功能,因为它换掉的是”你得会描述”这个前提。

在 ChatGPT 输入框输入 会弹出一个手绘面板。画完再补一句风格和细节的描述,它把草图当构图参考生成成品。

上面这张就是实际效果:左边那个火柴人加一辆歪歪扭扭的红车,右边是它照着位置关系出的成品。你画得多丑不重要——它要的是东西摆在哪,不是笔触。

官方给的例子是:房间布局草图变室内设计渲染图、人物轮廓草图变服装效果图。

这解决的是一个具体的沟通问题。 “杯子放桌子左边偏后一点、logo 在杯身右下角”——这句话写清楚要三十个字,还大概率被理解错;画出来五秒钟,没有歧义。凡是涉及”东西摆在哪”的需求,画比说快。

另外三个新入口

模板。 不用从空白开始,直接选”海报””周边”这类现成格式,再填你要传达的信息、设计元素、风格。适合你知道要什么、但不知道提示词怎么开头的时候。

图片内评论。 可以直接在图上某个位置标注一条评论,指着那儿说要改什么。跟”精准编辑”是一套的——以前靠文字描述位置,现在直接点。

分享提示词。 分享图片的时候可以把用过的提示词一起带出去,别人拿自己的照片套同一套。

这三个都不是模型能力,是把已有能力包装成不用学的入口。新功能里真正改变门槛的是 Sketch 和图片内评论,因为它们把”用文字描述空间位置”这道坎去掉了。

两个模型怎么选,钱怎么算

API 这边同时上了两个模型:

· GPT-Image-2.5 Flare — 质量、编辑、速度都升级,延迟最高比 Images 2.0 低 50%。跑量、要快的走这个。

· GPT-Image-2.5 Sunburst — 精度更高,代价是生成时间更长。出精品、成品级营销素材和精修产品图走这个。

这里有条到处都没提的:这俩在定价页上价格一模一样。

· 模型 · 图像输入 · 缓存输入 · 输出

· gpt-image-2.5-flare · $8.00 · $2.00 · $30.00

· gpt-image-2.5-sunburst · $8.00 · $2.00 · $30.00

· gpt-image-2 · $4.00 · $1.00 · $15.00

(每百万 token,文字 token 单独计价:2.5 两款都是 $5.00 / 缓存 $1.25,gpt-image-2 是 $2.50 / $0.625。)

两件事:

一,选 Flare 还是 Sunburst 跟钱无关。 价格完全相同,只差速度和精度,按业务选就行,不用算成本。

而且不只是价格一样。看 9 月 8 日的 Text-to-Image Arena 盲测榜:

Sunburst 1421 分排第一,Flare 1399 分排第二,gpt-image-2 的 medium 档 1381 分第三。但两个 2.5 的名次区间都标的是 1–2,也就是统计上分不出谁在前面。

有个前提得说清楚:两个 2.5 才各三千票左右,误差是 ±13;gpt-image-2 攒了 7.8 万票,误差只有 ±4。所以”2.5 比 2 强”这个结论站得住,但”Sunburst 比 Flare 强”目前看不出来——至少在这种纯文字出图的盲测里看不出来。Sunburst 的精度优势在官方说法里是给”细节要求高的编辑工作”,不是给一句话生成。

结论没变,反而更硬了:跑量和一般创作直接上 Flare,快一半、分数差不多、价钱一样。

二,从 gpt-image-2 升上来,单价整整翻一倍。 每一栏都是精确的 2 倍。跑量的场景升级前先算一遍——如果你的活并不吃”多轮改图不塌”这个能力,留在 gpt-image-2 上省一半钱是理性选择。

这套什么时候不管用

· 只发一张就完事的活,升级意义不大。 2.5 的价值全在”改”上。一次成型、不需要返工的场景,2.0 甚至 gpt-image-2 都够用,还便宜一半。

· 透明背景不是这次新增的。 gpt-image-2 八月就支持原生透明背景了,官方这次的说法是”能处理更复杂的版式,包括透明背景”——是改善,不是从零到一。别当新功能宣传。

· Sketch 帮你定构图,不帮你定审美。 它按你的草图摆位置,画面好不好看还是看后面那句风格描述。

· 多轮一致性是”更可靠”,不是”保证不变”。 官方用的词是 more reliably、more likely,没给成功率。真要拿去交付,每一轮还是得自己看。

· 具体额度官方没给数字。 官方只说 ChatGPT、ChatGPT Work、Codex 用户在桌面端、手机端、网页端都能用,各档订阅每天能生几张没公布,我也没核到可信的口径。

现在可以做的

  1. 打开 ChatGPT,输入框打 Sketch,随手画个东西,配一句风格描述,看它出什么——这一步三十秒,能立刻判断这功能对你有没有用。
  2. 找一张你之前改废过的图,重新上传,只提一个局部修改要求,连着改三轮,看画质掉不掉。这是验 2.5 到底值不值的唯一办法。
  3. 用 API 的,先去定价页对一遍自己的月用量。翻倍这件事,跑量的场景差别不小。