关于ZAKER Skills 合作
全天候科技 21小时前

OpenAI 发布 ChatGPT Images 2.5:生成速度最高提升 50%,AI 修图“指哪改哪”

美东时间 9 月 8 日周二,OpenAI 正式推出 ChatGPT Images 2.5,新一代图像生成模型主打更快生成、更高保真度和更精准的多轮编辑。

OpenAI 称,相比上一代 Images 2.0,Images 2.5 的生成延迟最高降低 50%,同时能够更好地保留人物、宠物等参考对象的外貌特征,并在连续多次修改后保持画面细节和构图的一致性。

这次升级的重点并不只是 " 生成一张更漂亮的图片 ",而是进一步降低 AI 图像创作的操作门槛。

OpenAI 新增名为 Sketch 的功能,用户可以直接在 ChatGPT 中画出草图,让 AI 据此生成完整图片;新增的模板则可以帮助用户快速制作海报、商品图等常见视觉内容。此外,用户现在可以直接在图片上添加评论、圈出需要修改的位置,让 AI 只改变指定部分,而无需反复重写提示词。

OpenAI 还同步面向开发者推出 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst 两款 API 模型。其中,Flare 兼顾速度、质量和编辑能力,生成延迟较 GPT-Image-2 最高降低 50%;Sunburst 则针对需要更精细控制的专业创作场景,允许更长的生成时间换取更高精度。

不只是 " 画得更好 ":人物、宠物和细节保真度进一步提升

OpenAI 此次首先强化的是图像生成的 " 保真度 "。

OpenAI 表示,Images 2.5 能够更好地利用参考照片,将熟悉的人物、宠物等对象转换到不同场景、视觉风格和构图中,同时提高对光线、纹理以及人物独特特征的保留能力。对于需要持续制作系列素材的商业用户,这意味着同一个人物、产品或品牌视觉元素在多次生成和修改后,更不容易 " 变脸 "。

这一点也是此前 AI 图像生成器的一大痛点:模型可能第一次生成得很好,但一旦用户要求修改某个局部,人物五官、宠物外貌甚至整体构图都可能发生变化。

OpenAI 此次特别强调了 " 多轮编辑一致性 "。在连续对话中,Images 2.5 能够更好地记住此前已经完成的修改,让后续调整建立在上一版本基础上,而不是每一次都重新生成一张 " 差不多 " 的图片。

在提前体验中,媒体 Axios 也观察到了类似变化。该媒体测试了人物、宠物照片、纹身设计和 Logo 等任务,发现 Images 2.5 在保留人物和宠物特征以及进行局部修改方面明显改善。比如,Axios 将一只猫的照片转换为电影黑色、彩色玻璃和文艺复兴肖像等不同风格,模型仍能较好地抓住原照片中猫的特征。

" 圈哪里、改哪里 ":AI 修图从改提示词变成直接操作图片

相比画质提升,更值得关注的是 Images 2.5 对编辑方式的改变。

OpenAI 新增了直接在图片上添加评论的功能。用户可以在画面中指定一个位置,然后告诉 AI" 删除这里 "" 把这里改成蓝色 " 等,模型只针对指定区域进行修改,同时尽可能保持其余部分不变。

Axios 的实际测试显示,这一方式尤其适合需要反复调整的创作场景。例如,在纹身设计测试中,用户上传已有纹身照片,再要求 AI 增加新的元素,并通过圈选特定区域要求调整颜色和细节,模型可以根据这些局部指令继续修改。

TechRadar 则认为,这可能是 Images 2.5 最实用的升级之一。其测试发现,用户过去需要不断重新描述 " 把这里变亮 "" 删除背景中的人 " 等要求,而现在可以直接指出图片中的具体位置再进行修改;编辑工具还包括删除背景、擦除对象、调整尺寸等功能,并能够回溯此前的不同版本。

这意味着 AI 修图正在从 " 语言驱动 " 进一步走向 " 视觉交互 ":用户不必准确描述一个物体在图片中的位置,只需直接指出它。

不会画画也能创作:Sketch 把 " 草图 " 变成成品

Images 2.5 的另一个重要变化,是新增 Sketch 功能。

用户可以直接在 ChatGPT 中画一个非常粗略的草图,例如画出房间布局、服装轮廓或者一个简单的物体,然后让 AI 根据这张草图生成完整图片。OpenAI 表示,用户只需在 ChatGPT 中输入 "@Sketch" 即可使用。

TechRadar 实际测试认为,Sketch 并不需要用户具备绘画能力,即便只是用鼠标或手指画出简单轮廓,也可以作为 AI 生成图片的视觉参考。生成之后,用户还可以继续进入编辑模式进行调整。

Axios 也将 Sketch 视为此次更新的重要变化之一。OpenAI 图像产品负责人 Adele Li 向 Axios 表示,Sketch 和模板的设计目的之一,是让用户更多参与创作过程,而不是让用户成为一个完全被动的生成者。

她表示,OpenAI 希望改变所谓的 " 单一 AI 审美 ",并称:" 我不希望在现实世界里一眼就能看出这是 ChatGPT 生成的东西,我希望人们能够生成并表达自己的个性。"

这也透露出 OpenAI 对 AI 图像产品定位的变化:AI 不只是替用户 " 做图 ",而是试图成为创作过程中的工具,让用户保留更多控制权。

模板降低创作门槛,AI 图像开始瞄准 " 实际用途 "

除了 Sketch,OpenAI 还加入了模板功能。

用户可以从海报、商品图等常见视觉格式开始,而不必面对一块完全空白的画布,再逐步补充文字、设计元素和风格。

TechRadar 测试了商品图模板:用户上传产品照片后,可以进一步选择清洁摄影棚、编辑风格、生活方式等视觉风格,再选择具体场景,由 ChatGPT 完成生成。该媒体认为,对于那些已经明确 " 想做什么 " 但不知道如何开始的用户,模板能够明显降低使用门槛。

OpenAI 也在进一步加强图像在商业工作流中的适用性。公司称,Images 2.5 不仅适用于个人创作,也针对营销、零售、媒体等场景进行了优化,包括品牌素材、网站视觉、产品展示图以及系列化内容生产等。

OpenAI 官方数据显示,目前用户每周通过 ChatGPT Images 以及 API 中的 GPT-Image 系列模型生成超过 30 亿张图片。

API 同步升级:Flare 主打速度,Sunburst 瞄准专业创作

在 ChatGPT 产品升级之外,OpenAI 也在 API 端推出两款新模型。

GPT-Image-2.5 Flare 主打速度、质量和编辑能力,是面向大多数应用的默认选择。OpenAI 称,Flare 相比 GPT-Image-2 能够提供更高质量的图片,同时延迟降低 50%,适合社交内容、创作者应用、商品体验、视觉搜索以及大规模图片生成等场景。

GPT-Image-2.5 Sunburst 则定位更加专业。OpenAI 表示,该模型针对需要更精细控制的高端视觉工作流设计,适用于广告创意、生产级营销素材和精细商品图片等场景,以更长的生成时间换取更高的控制精度。

OpenAI 披露,Higgsfield AI、Adobe 和 Manus 已经开始使用新模型。其中,Manus 表示,其评估显示 Flare 的生成速度是 GPT-Image-2 的 2 至 4 倍,同时透明背景生成能力也有所提升。

" 更像工具 " 而非 " 更像画师 ",OpenAI 押注下一阶段 AI 创作

从 Images 2.0 到 2.5,OpenAI 此次并没有简单追求模型 " 画得更逼真 ",而是把大量升级集中在控制、修改和连续创作上。

TechRadar 在连续 24 小时测试后认为,这次升级虽然未必达到 "Images 3.0" 式的跨代变化,但改进已经足以改变日常使用方式;尤其是局部编辑、Sketch 和模板,更可能成为用户频繁使用的功能。

Axios 的体验则显示,随着模型对人物特征、局部细节和连续修改的掌控能力增强,AI 生成图片与传统设计工具之间的界限正在进一步模糊。该媒体同时指出,AI 生成图像仍然存在明显的伦理争议,包括模型训练所使用的艺术作品是否得到创作者授权和补偿等问题。

而 OpenAI 显然希望通过 Sketch、模板和可视化编辑,把用户重新拉回创作流程。

如果说早期 AI 图像生成解决的是 "我说一句话,你帮我画出来",那么 Images 2.5 正在尝试解决的是 "我告诉你哪里不对,你帮我把它改对"。

这或许才是此次更新最值得关注的地方:AI 图像生成正在从一次性的 " 出图工具 ",进一步变成可以持续沟通、反复修改并服务于真实创作流程的交互式设计工具

全天候科技

全天候科技

提供专业快速完整的科技商业资讯

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容