AI 日报hiw3c.com

AGI时代的第一个生图模型,ChatGPT Images 2.5上线

量子位 www.qbitai.com 网页快照

AGI时代的第一个生图模型,ChatGPT Images 2.5上线

henry 发自 凹非寺 量子位 | 公众号 QbitAI

刚刚,OpenAI发布新一代生图模型, ChatGPT Images 2.5 ,主打生成更快,细节更好,改图也终于越来越像“真·修图”了。

生图更快,相比Images 2.0,生成延迟最多降低50%;

只要用鼠标(或者随便什么)画一张草图,再补充你想要的风格和细节,GPT就会把它作为视觉参考,生成完整图片。

By the way,现在GPT终于支持看百分比的生成进度了,不用再问“在吗”看网断没断了!

重点补的是细节和“别乱动”

如果说上面这些是功能层面的变化,那么从这次技术博客来看,相比4个半月前发布的GPT Image 2,Images 2.5真正值得看的升级,还是 生成质量和编辑稳定性本身 。

Images 2.5并没有单纯继续往上堆输出分辨率,最高依然是3840px,但新增了 xhigh和max质量档位 ,进一步提升细节、材质纹理、光照,以及参考主体的保真度。

给小孩哥换了一身衣服之后,脸部基本没怎么漂,尤其是原图里卷发那种稍微有点毛躁的质感,保留得相当完整。

而相比单纯“把图画得更漂亮”,Images 2.5这次更重要的一个方向就是让修图改图变得更加可控。

虽然有些图看起来还是稍微有点“AI塑料感”,但人物本身、场景关系和整体构图已经能比较稳定地保留下来。

不用再写一大段“请把画面左上角第二个人脸上的墨镜换成黑框眼镜”,直接圈那个地方,写一句要求就行。

很多时候,对于设计工作者来说,一张图不可能一遍生成就结束。第一轮把主体生成出来,第二轮改排版,第三轮换文字,第四轮再抠一些细节。

OpenAI表示,在更长的对话中,Images 2.5可以更稳定地接着上一轮结果继续修改,同时保住已经确认好的内容和画质。

比如下面这种旅行攻略海报,文字、照片、路线、排版全挤在一张图里,修改时需要同时照顾的元素比单主体图片多得多。

生图才是正经事儿

当然,除了编辑之外,Images 2.5对复杂画面、材质和风格指令的理解也一起升级了。

当然了,生图这玩意,本质上还是创造力工具。就像奥特曼说的,它又不是拿来做数学题的。

所以到底是史诗级升级,还是熟悉的“这边补好了,那边又冒出新Bug”,大家实测下来也可以说说。

生成延迟最多减半,API一次上了两个版本

它更强调质量、编辑能力和速度之间的平衡,也是官方推荐的大多数应用默认使用的版本,适合社交内容、快速视觉原型和大批量生图等场景。

它瞄准的是更精细的创作和编辑需求,比如正式投放的广告素材、产品图片,以及对画质要求更高的视觉内容。

所以整体看下来,Images 2.5这次跟2那种直接生成老照片质感的视觉冲击还差点意思?

但它确实把生成模型开始真正进入生产流程之后,那些不多轮交互、定点修改的问题进一步清扫了一遍。

参考链接 [1]https://openai.com/index/introducing-chatgpt-images-2-5/ [2]https://x.com/sama/status/2097410967978324010

李飞飞刚发Atlas,中国开源“同款”已抢跑半年? 2026-09-04

今年最难的机器人Demo,“机器人含量”为0 2026-09-03

GitHub最热架构图Agent,开发者故事看哭了 2026-09-01

相关阅读

清华AIR开源轻量版BioMedGPT!聂再清:最终目标是生物医药领域基础大模型

语言模型GPT跨界CV,OpenAI揭示强算力Transformer具有通用性

北大数学课,启用AI助教

大神卡帕西这么用ChatGPT:日常4o快又稳,烧脑切o4,o3当备胎用

本科学历但创造出GPT,奥特曼盛赞为「爱因斯坦级」天才,OpenAI总裁更是直言: 只要他想要的,我们都给。

不用跟AI客气了!新研究:语气越粗鲁回答正确率越高

热门文章

刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

趋境科技与摩尔线程达成战略合作,高品质 AI Token 国产异构方案性价比超越国际先进算力

李飞飞刚发Atlas,中国开源“同款”已抢跑半年?

陶哲轩吐槽GPT-6孪生素数新突破:令人无语的一幕

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1