Py学习  »  chatgpt

OpenAI ChatGPT Images 2.5全量开放,多轮图像编辑稳定性大幅提升

科技小资讯 • 3 小时前 • 11 次点击  

OpenAI 宣布 ChatGPT Images 2.5 图像模型正式全量开放,新版本将图像编辑延迟最高下降 50%,针对性解决旧模型多次迭代画面崩坏的痛点,在多轮修改场景下能够锁定主体,避免画面主体偏移问题,网页端、移动端、桌面端同步上线该能力,配套 API 调用接口也同步对外开放,供开发者集成使用。
在核心性能优化方面,对比 Images 2.0 版本,2.5 模型的图像生成与编辑延迟最高降低 50%,创作者在反复调整画面的过程中无需长时间等待,大幅提升创意迭代效率。此前图像生成模型普遍存在一个痛点,在对同一张图片做多轮修改时,模型容易连带改动画面主体,出现人物、物体移位、画面结构崩坏等问题,每一轮编辑都相当于重新生成一张新图,很难持续打磨同一套画面构图。本次升级重点优化多轮编辑一致性,模型可以识别用户仅需修改的局部区域,锁定主体位置、形态与画面构图,只改动指定部分,在多次迭代中保持主体稳定不偏移。同时模型对画面光影、纹理细节的渲染效果得到优化,画面真实度更高。
在使用渠道上,ChatGPT Images 2.5 面向网页端、移动端以及桌面端全平台开放,普通用户、企业用户均可在对应客户端直接使用图像生成与精准编辑功能。API 层面同步推出两个版本模型,GPT‑Image‑2.5 Flare 主打高速生成,适配绝大多数应用场景;GPT‑Image‑2.5 Sunburst 侧重高精度创作,适合对画面细节要求严苛的专业视觉制作场景,开发者可按需选择模型接入自身业务系统,搭建 AI 图像生成应用。
从落地场景来看,该模型能够覆盖自媒体内容创作、产品效果图制作、海报设计、概念草图迭代等大量视觉工作场景。设计师、内容创作者可以持续在原图基础上反复微调局部细节,不用每次修改后重新对齐主体,有效降低 AI 绘图的返工成本。
从行业角度分析,多轮编辑一致性是文本生成图像领域长期存在的技术难点,Images 2.5 的迭代,标志着 AI 图像模型从单纯 “生成图片”,转向支持连贯的、可持续打磨的视觉创作流程。不过该模型依旧存在一定局限,面对超复杂场景、精细手部结构等内容,依旧有可能出现细节瑕疵,还无法完全替代专业设计软件的精细化处理能力。

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/200958