OpenAI 发布 ChatGPT Images 2.5 图像模型
Introducing ChatGPT Images 2.5
OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。
官方原文给出与 Images 2.0 的具体对比数据、新功能入口和 API 双模型分工,读者可以据此评估是否迁移现有图像工作流。
推出 ChatGPT Images 2.5 推出 C h a t G P T I m a g e s 2.5 C
h
a
t
G
P
T
I
m
a
g
e
s
2
.
5

更锐利的细节、更快的生成速度、更精准的编辑,以及更出色的创作与分享工具。
每周,人们在 ChatGPT Images 以及 API 中的 GPT‑Image 模型上创建超过 30 亿张图像。今天,我们通过 ChatGPT Images 2.5 拓展你的创作能力——这是我们全新的最先进图像模型,为你的创作流程带来更锐利的细节、更精准的编辑和更快的生成速度。
Images 2.5 能生成更自然的光照和更丰富的纹理,更擅长保留参考照片中的主体,并且能在多轮对话中更可靠地遵循编辑指令。与 Images 2.0 相比,我们还将图像生成延迟降低了最多 50%,让你能更快地生成图像并完善你的创意构想。
在 ChatGPT 中,我们正在推出一些产品功能,让你对创作过程拥有更多掌控。Sketch 是一项新功能,让你可以直接在 ChatGPT 中绘图,作为最终图像的参考。模板让你更容易上手创作一些最流行的图像格式,比如传单和产品照片。你现在还可以直接在图像上添加评论,以实现更聚焦的编辑,并且可以分享你用过的提示词,让他人用自己的照片和细节来尝试你的创意。
Images 2.5 现已面向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端。
对于开发者,我们在 API 中推出两款新模型。GPT‑Image‑2.5 Flare 带来了在质量、编辑和速度方面同样的提升,而 GPT‑Image‑2.5 Sunburst 则为精细的创意工作提供了更高一级的精度,生成时间也更长。
创作时的图像保真度
最有意义的图像,往往扎根于它们所依据的真实人物、地点和记忆。Images 2.5 更擅长基于参考照片,将熟悉的主体转换到新的场景、视觉风格和构图中。图像主体看起来更易辨认,光线和质感更自然,鲜明特征也更有可能得以保留。
对于使用 API 进行构建的团队来说,同样的保真度让以参考为主导的工作流更加可靠,因此变体能够始终锚定于原始来源。

ChatGPT Images 2.5

输入
精准编辑
我们让你更轻松地进行聚焦式编辑,从而获得更贴合你实际想法的最终图像。Images 2.5 更擅长只编辑你所要求的部分,同时保持其余细节不变——即便面对更复杂的主题和背景也是如此。
对于使用 Images API 的开发者而言,这使用户能够更新单个元素——例如某个产品、背景或一段文案——同时保留其周围的主体、构图和品牌处理。
以下视频由多张图像组成,展示了该模型在遵循精准编辑指令方面提升的能力。
多轮编辑一致性
在较长的 ChatGPT 对话中,Images 2.5 能在多次编辑中更可靠地遵循具体的编辑指令。此前的修改更有可能保持一致,每一次新的编辑都建立在你已完成的工作之上,而不会随时间推移导致图像质量下降。
这种一致性在生产工作流中同样重要,开发者需要在其中进行有针对性的修改,而无需重建整个素材。
以下视频由多张图像组成,展示了该模型在多轮编辑中保持图像质量方面提升的能力。

智能与风格改进
Images 2.5 更擅长理解复杂的视觉指令,并将其转化为连贯的结果。包含真实世界信息的图像内容更加准确,模型也能处理更复杂的布局,包括透明背景。它还更擅长体现视觉风格,因此你的图像能更贴合你的艺术构想。
对于开发者和企业而言,这让复杂的创意简报变得更加可靠。模型更有可能保留所要求的视觉方向、构图和各个细节,而不会随着指令变得更为具体而偏离。在生成一系列符合品牌调性的创意素材、保持既定层级结构的 UI 概念,或契合特定结构的演示视觉稿时,这一点尤为重要。










用 Sketch 把你的想法画出来
有时候,解释一个想法最清晰的方式就是把它画出来。
我们推出 Sketch,这是一项新功能,让你可以直接在 ChatGPT 中绘画,并将其用作视觉指引。现在你可以快速勾勒一个房间的布局、你正在构思的服装轮廓,或者只是随手画个有趣的涂鸦,ChatGPT 会把你的粗略画作变成一幅完整的图像。再添加风格描述以及任何其他细节,以确保它体现你的构想。
你不需要成为专业艺术家——这只是让你的最终图像更接近你心中所想的另一种方式。要亲自尝试,只需在 ChatGPT 中输入“@Sketch”。

优化提示词结构,获得更好结果
有时你可能已经清楚自己想做什么——只是需要一些帮助来起步。
我们为一些最受欢迎的创意形式推出了模板。你不必再从空白画布开始,而是可以选择“海报”或“周边商品”等模板,并添加要传达的信息、设计元素或风格等细节,让结果更具个性化。

把你最好的创意传递下去
你常常会得到一张好到忍不住想分享的图片。
现在,当你分享一张图片时,还可以选择附上帮你生成它的提示词。其他人就能沿用同一个创意,加入自己的图片和细节,做出一个属于自己的版本。
例如,试试这个提示词 ,它目前正在走红,看看你在80年代会是什么样子!

API 中的 Images 2.5
开发者每天都在通过 Images API 将图像生成工作流构建到创意、营销、零售和媒体团队使用的产品中。
我们在 API 中发布了两款新的图像模型:
GPT‑Image‑2.5 Flare 将同样在质量、编辑和速度上的改进带到了 API,是大多数应用的默认选择,相比 GPT‑Image‑2 能生成更高质量的图像,同时延迟降低 50%。它适用于从创作者和社交内容到产品体验、视觉搜索、快速图像原型制作以及大批量生成的各种场景。
GPT‑Image‑2.5 Sunburst 专为高端视觉工作流打造,适合在多次编辑中需要更精细控制的场景。可用于创意和编辑工作流,例如可直接投产的营销活动创意或精致的产品图像。
以下是早期客户对这些新模型的评价:
“GPT‑Image‑2.5 Flare 最让我们印象深刻的是它对哪些内容不该改动的理解非常到位。你可以在进行有意义的编辑的同时,不丢失原图的角色特征、构图或视觉识别度。这对于创作者和团队在影视、UGC 和广告领域的实际工作方式来说极其重要。而当你把这种级别的控制力与速度、质量和成本结合起来时,GPT‑Image‑2.5 Flare 确实脱颖而出。”
Axultan Alimkulov,Higgsfield AI 产品负责人
“Adobe Firefly 是我们的创意 AI 工作室,让创作者在从创意到成品内容的整个过程中拥有灵活性和掌控力,将领先的 AI 模型与 Adobe 的专业级工具汇聚于一处。我们很高兴能通过 OpenAI 最新的 GPT‑Image‑2.5 模型现已登陆 Firefly 来扩展这一选择,带来更快的生成速度和分辨率一致性,让图像在每一次细化中都保持锐利和照片级真实感。”
Matt Chotin,Adobe 产品高级总监
“GPT‑Image‑2.5 是令人印象深刻的一大进步。在我们的评估中,Flare 以 GPT‑Image‑2 两到四倍的速度交付高质量图像。凭借改进的透明背景生成能力,它非常适合 Manus 上的创意工作,从品牌资产到演示文稿和网站皆可胜任。”
Lucky Liao,Manus 评估团队
我们对安全的承诺
我们正在将图像生成打造得实用、富有创意且安全。ChatGPT Images 2.5 建立在我们现有防护措施的基础之上,对提示词和图像进行检查,以帮助防止有害输出。我们继续使用 C2PA 元数据和不可见水印来帮助识别使用我们工具生成的图像。你可以在 系统卡中进一步了解我们的评估和方法。
定价与可用性
Images 2.5 今日起向所有层级的 ChatGPT、ChatGPT Work 和 Codex 用户推出,覆盖桌面端、移动端和网页端。
GPT‑Image‑2.5 Sunburst 和 GPT‑Image‑2.5 Flare 已在 API 中提供。请在此处查看 定价详情。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com