OpenAI发布ChatGPT Images 2.5:生成速度最高提升50%,AI修图“指哪改哪”

新增功能Sketch让AI根据用户直接在ChatGPT画出的草图生成完整图片;新增模板可帮助用户快速制作海报、商品图等常见视觉内容。用户可直接在图片上添加评论、圈出需修改的位置,让AI只改变指定部分,无需反复重写提示词。OpenAI还面向开发者推出API模型GPT-Image-2.5 Flare和GPT-Image-2.5 Sunburst,前者主打速度,后者瞄准专业创作。

美东时间9月8日周二,OpenAI正式推出ChatGPT Images 2.5,新一代图像生成模型主打更快生成、更高保真度和更精准的多轮编辑。

OpenAI称,相比上一代Images 2.0,Images 2.5的生成延迟最高降低50%,同时能够更好地保留人物、宠物等参考对象的外貌特征,并在连续多次修改后保持画面细节和构图的一致性。

这次升级的重点并不只是“生成一张更漂亮的图片”,而是进一步降低AI图像创作的操作门槛。

OpenAI新增名为Sketch的功能,用户可以直接在ChatGPT中画出草图,让AI据此生成完整图片;新增的模板则可以帮助用户快速制作海报、商品图等常见视觉内容。此外,用户现在可以直接在图片上添加评论、圈出需要修改的位置,让AI只改变指定部分,而无需反复重写提示词。

OpenAI还同步面向开发者推出GPT-Image-2.5 Flare和GPT-Image-2.5 Sunburst两款API模型。其中,Flare兼顾速度、质量和编辑能力,生成延迟较GPT-Image-2最高降低50%;Sunburst则针对需要更精细控制的专业创作场景,允许更长的生成时间换取更高精度。

不只是“画得更好”:人物、宠物和细节保真度进一步提升

OpenAI此次首先强化的是图像生成的“保真度”。

OpenAI表示,Images 2.5能够更好地利用参考照片,将熟悉的人物、宠物等对象转换到不同场景、视觉风格和构图中,同时提高对光线、纹理以及人物独特特征的保留能力。对于需要持续制作系列素材的商业用户,这意味着同一个人物、产品或品牌视觉元素在多次生成和修改后,更不容易“变脸”。

这一点也是此前AI图像生成器的一大痛点:模型可能第一次生成得很好,但一旦用户要求修改某个局部,人物五官、宠物外貌甚至整体构图都可能发生变化。

OpenAI此次特别强调了“多轮编辑一致性”。在连续对话中,Images 2.5能够更好地记住此前已经完成的修改,让后续调整建立在上一版本基础上,而不是每一次都重新生成一张“差不多”的图片。

在提前体验中,媒体Axios也观察到了类似变化。该媒体测试了人物、宠物照片、纹身设计和Logo等任务,发现Images 2.5在保留人物和宠物特征以及进行局部修改方面明显改善。比如,Axios将一只猫的照片转换为电影黑色、彩色玻璃和文艺复兴肖像等不同风格,模型仍能较好地抓住原照片中猫的特征。

“圈哪里、改哪里”:AI修图从改提示词变成直接操作图片

相比画质提升,更值得关注的是Images 2.5对编辑方式的改变。

OpenAI新增了直接在图片上添加评论的功能。用户可以在画面中指定一个位置,然后告诉AI“删除这里”“把这里改成蓝色”等,模型只针对指定区域进行修改,同时尽可能保持其余部分不变。

Axios的实际测试显示,这一方式尤其适合需要反复调整的创作场景。例如,在纹身设计测试中,用户上传已有纹身照片,再要求AI增加新的元素,并通过圈选特定区域要求调整颜色和细节,模型可以根据这些局部指令继续修改。

TechRadar则认为,这可能是Images 2.5最实用的升级之一。其测试发现,用户过去需要不断重新描述“把这里变亮”“删除背景中的人”等要求,而现在可以直接指出图片中的具体位置再进行修改;编辑工具还包括删除背景、擦除对象、调整尺寸等功能,并能够回溯此前的不同版本。

这意味着AI修图正在从“语言驱动”进一步走向“视觉交互”:用户不必准确描述一个物体在图片中的位置,只需直接指出它。

不会画画也能创作:Sketch把“草图”变成成品

Images 2.5的另一个重要变化,是新增Sketch功能。

用户可以直接在ChatGPT中画一个非常粗略的草图,例如画出房间布局、服装轮廓或者一个简单的物体,然后让AI根据这张草图生成完整图片。OpenAI表示,用户只需在ChatGPT中输入“@Sketch”即可使用。

TechRadar实际测试认为,Sketch并不需要用户具备绘画能力,即便只是用鼠标或手指画出简单轮廓,也可以作为AI生成图片的视觉参考。生成之后,用户还可以继续进入编辑模式进行调整。

Axios也将Sketch视为此次更新的重要变化之一。OpenAI图像产品负责人Adele Li向Axios表示,Sketch和模板的设计目的之一,是让用户更多参与创作过程,而不是让用户成为一个完全被动的生成者。

她表示,OpenAI希望改变所谓的“单一AI审美”,并称:“我不希望在现实世界里一眼就能看出这是ChatGPT生成的东西,我希望人们能够生成并表达自己的个性。”

这也透露出OpenAI对AI图像产品定位的变化:AI不只是替用户“做图”,而是试图成为创作过程中的工具,让用户保留更多控制权。

模板降低创作门槛,AI图像开始瞄准“实际用途”

除了Sketch,OpenAI还加入了模板功能。

用户可以从海报、商品图等常见视觉格式开始,而不必面对一块完全空白的画布,再逐步补充文字、设计元素和风格。

TechRadar测试了商品图模板:用户上传产品照片后,可以进一步选择清洁摄影棚、编辑风格、生活方式等视觉风格,再选择具体场景,由ChatGPT完成生成。该媒体认为,对于那些已经明确“想做什么”但不知道如何开始的用户,模板能够明显降低使用门槛。

OpenAI也在进一步加强图像在商业工作流中的适用性。公司称,Images 2.5不仅适用于个人创作,也针对营销、零售、媒体等场景进行了优化,包括品牌素材、网站视觉、产品展示图以及系列化内容生产等。

OpenAI官方数据显示,目前用户每周通过ChatGPT Images以及API中的GPT-Image系列模型生成超过30亿张图片。

API同步升级:Flare主打速度,Sunburst瞄准专业创作

在ChatGPT产品升级之外,OpenAI也在API端推出两款新模型。

GPT-Image-2.5 Flare主打速度、质量和编辑能力,是面向大多数应用的默认选择。OpenAI称,Flare相比GPT-Image-2能够提供更高质量的图片,同时延迟降低50%,适合社交内容、创作者应用、商品体验、视觉搜索以及大规模图片生成等场景。

GPT-Image-2.5 Sunburst则定位更加专业。OpenAI表示,该模型针对需要更精细控制的高端视觉工作流设计,适用于广告创意、生产级营销素材和精细商品图片等场景,以更长的生成时间换取更高的控制精度。

OpenAI披露,Higgsfield AI、Adobe和Manus已经开始使用新模型。其中,Manus表示,其评估显示Flare的生成速度是GPT-Image-2的2至4倍,同时透明背景生成能力也有所提升。

“更像工具”而非“更像画师”,OpenAI押注下一阶段AI创作

从Images 2.0到2.5,OpenAI此次并没有简单追求模型“画得更逼真”,而是把大量升级集中在控制、修改和连续创作上。

TechRadar在连续24小时测试后认为,这次升级虽然未必达到“Images 3.0”式的跨代变化,但改进已经足以改变日常使用方式;尤其是局部编辑、Sketch和模板,更可能成为用户频繁使用的功能。

Axios的体验则显示,随着模型对人物特征、局部细节和连续修改的掌控能力增强,AI生成图片与传统设计工具之间的界限正在进一步模糊。该媒体同时指出,AI生成图像仍然存在明显的伦理争议,包括模型训练所使用的艺术作品是否得到创作者授权和补偿等问题。

而OpenAI显然希望通过Sketch、模板和可视化编辑,把用户重新拉回创作流程。

如果说早期AI图像生成解决的是“我说一句话,你帮我画出来”,那么Images 2.5正在尝试解决的是“我告诉你哪里不对,你帮我把它改对”。

这或许才是此次更新最值得关注的地方:AI图像生成正在从一次性的“出图工具”,进一步变成可以持续沟通、反复修改并服务于真实创作流程的交互式设计工具

相关文章