ChatGPT Images 2.5实测:确实好用,就是爱乱改

来源: 网易智能2026-09-11 08:35:39
  

出品 | 网易智能

作者 | 小扣


(相关资料图)

编辑 | 王凤枝

9月8日,OpenAI发布ChatGPT Images 2.5,向ChatGPT、ChatGPT Work和Codex用户开放。除了复杂版式和草图转图片,这次官方重点介绍了精确编辑:参考图里的主体能保留得更好,连续修改也更一致。公司还称,生成延迟较Images2.0最高降低50%。

看完介绍,我更好奇的是:Images 2.5这次能不能和Nano Banana 2、即梦拉开差距?真拿来做海报、排日程、出效果图,哪家的成品更值得留下,哪些地方还得自己动手改?

于是,我在Codex里用ChatGPT Images 2.5,又找来Gemini里的Nano Banana 2和即梦图片5.0 Pro,做同样的五道题:连续修照片、做商品海报、排中文日程、把店铺草图变成效果图,再修复一张真实老照片。

每个平台提交八次,共留下24张用于比较的结果。提示词、附件顺序和画幅要求相同,连续编辑留在同一个对话里,每轮只取第一次结果,不因为“不够好看”重新抽卡。

五道题做完,四道里我更愿意留下ChatGPT的版本。但它也没少自作主张:海报只让换口味,整瓶水都跟着变粉;咖啡馆效果图看着不错,放大才发现门把手不对。

01换外套、拿杯子,其他地方别动

先从一张室内人物图开始。一个人穿着藏蓝色外套,坐在墨绿色扶手椅上,旁边蹲着一只橘猫。桌上放着红色马克杯、白色台灯和一本打开的书,背景还有两幅墙画和一扇窗。

我让三家分两步改:先把外套换成米白色,再从改好的图里拿走杯子。脸、头发、双手、猫和家具都得留住,构图与光线也不能变。

T01原始输入

第一轮提示词是:

只把人物的藏蓝色外套改成米白色。人物的脸、发型、表情、姿势和手,橘猫、家具、杯子、书、墙画、窗户、构图和光线全部不变;不要增删其他物体,保持原图尺寸。

图:第一轮只改外套颜色,可以对照原图看人、猫和房间有没有变化。

第一轮都做成了。外套换了颜色,人物、猫、家具和主要构图也都在。放大看,ChatGPT与原图最贴近,Nano Banana 2和即梦略有重绘感,但还在可以接受的范围内。

我又接着让它们拿走杯子。这一步得在刚才的结果上做,不能把外套变回藏蓝色:

在上一张结果上只移除红色马克杯,并自然补全桌面。米白色外套和其余内容全部保持不变。

图:第二轮移除杯子,米白色外套要保留。这里比较的是可见变化,没有做逐像素检查。

三家都拿走了杯子,外套颜色也没有退回去。两轮看下来,我会留ChatGPT这一份,其他地方没有明显被一起“翻新”。这一题的差别不大,另外两家的结果也能用。

02青柚换白桃,整瓶水都变粉了

海报这题,我准备了一个虚构品牌“山岚气泡水”,同时给出三份素材:产品正面、产品侧面与纸箱,以及一张品牌小规范。

先做一张4:5的青柚味新品海报,再把它改成白桃味。第二次修改只准换口味、两片水果和点缀色,版式、机位、光线都不能动。我想看的是,第一张做得满意之后,能不能接着用它改出同系列的下一张。

图:三家拿到的素材相同。产品、包装和品牌规范均为程序绘制的虚构素材,不是参赛模型的输出。

第一轮提示词是:

用附件B1–B3制作一张4:5中文新品海报。瓶身和Logo不得变形;画面只能出现“山岚气泡水”“青柚味”“0糖0脂0能量”“9月限定”四组文字。使用品牌墨绿色和暖白色,表现玻璃瓶、水珠、青柚和纸箱的真实材质,不要增加价格、英文、二维码或额外功效。

图:青柚版首稿,留意产品材质、文字位置,以及纸箱上的信息。

只看首稿,我最喜欢ChatGPT。标题、产品和卖点的层级清楚,玻璃、水珠、水果和纸箱也有质感,更像一张可以交给设计师继续收尾的广告。Nano Banana 2的材质感不差,但右侧卖点挤到了边缘;即梦比较简洁,纸箱却沿用了素材里的“12瓶装”,超出了指定的四组文字。

接下来改成白桃味。这次只给了一句要求:

只把“青柚味”改成“白桃味”,青柚换成两片白桃,点缀色改为浅粉色。Logo、瓶身、其他文字、版式、机位和光线不变。

图:白桃版二次修改。和上一张对照,瓶盖、液体、包装颜色与水果数量的变化都很明显。

ChatGPT这次改得有点多。瓶盖、瓶中液体、纸箱侧面和圆形徽章一起变粉,还加了整桃和额外桃块,没守住“两片白桃”的要求。NanoBanana 2也把瓶盖和液体改了色,桃肉不止两片。

即梦反而最接近“只改我说的地方”:原版式和产品机位保留得好,水果数量也最接近要求。但它又少做了一步,浅粉色点缀几乎没加上。

这题选不出一个全程最好的。ChatGPT首稿更像成品,即梦第二次修改更克制,三家都还有没改对的地方。

03临时改一场,别把整天的日程弄乱

AI作图的用途已经不只是配一张好看的插图,也包括海报、产品介绍这类需要承载大量文字的材料。信息一多,内容要写全、写对,还得让人容易找到重点;临时修改时,也不能把其他地方一起改乱。我用一张中文活动日程来试试。

这一题不提供参考图,只给九行中文日程和一行页脚,让模型自己排版。要求读者三秒内能找到午餐、下午第一场和结束时间,所有文字原字原序保留。做完之后,再临时调整14:10这一场。

第一轮提示词的重点是:

制作一张16:9中文日程信息图,标题为“2026 AI体验营|一日议程”。所有日程文字必须原字原序保留;让读者三秒内找到午餐、下午第一场和结束时间;不要加Logo、英文、二维码或新内容。

图:同一份排期生成的三张日程图,可以逐行核对时间、地点和讲者。

ChatGPT把九行日程和页脚都写对了,午餐、下午第一场和结束时间也容易找。即梦主体信息基本完整,只是又加了一个“2026”胶囊标签。

Nano Banana 2的问题更明显:13:10这一场重复了,其中一条活动名被截断,地点也写错。同一个时段多出一场活动,这张图就没法直接发出去。

第二轮,我只让它们改14:10–15:00这一场,活动名换成“智能体安全演练”,讲者换成“周禾”:

只修改14:10–15:00这一场:活动名改为“智能体安全演练”,讲者改为“周禾”,地点仍是“B2厅”,旁边增加“场地不变”橙色标签。其他内容和版式不变。

图:修改14:10这一场之后,ChatGPT保住了其余排期,Nano Banana 2也保留了第一轮的重复错误。

ChatGPT改好了指定场次,其他内容和版式没有明显变化。NanoBanana 2也完成了这次替换,但13:10那两条还在。这道题,我会直接留下ChatGPT的版本。

04草图变效果图,漂亮不等于照图施工

接着试一间社区书店咖啡馆。我给出一张俯视草图,把布局先定下来:左边是双开玻璃门,右边两扇落地窗,中间是L形吧台,后墙六格书架,左前方放双人桌,右侧留出90厘米主通道,相机位置也标好了。

模型可以发挥的是材质和傍晚的光线。门窗、桌子和走道已经有了位置,不需要再替我设计一遍。

实际提示词是:

严格按附件C的门窗、吧台、书架、桌子、通道和机位,生成一张16:9写实的傍晚社区书店咖啡馆。材质用胡桃木、暖白石材、拉丝不锈钢和磨砂玻璃,室内暖光、窗外蓝调;吧台只放咖啡机、两只白杯和一盆蕨类。不要加人物,不要改变门窗数量或堵住通道;成图不要保留草图文字和标线。

图:上方是草图,下方是三家效果图。先看门窗、吧台、书架和桌子能不能一一对上。

第一眼看,ChatGPT最接近草图。门窗、后墙书架、L形吧台和双人桌都容易找到,傍晚的气氛也有了。

放大之后,问题才冒出来。左侧双开玻璃门上,多根金属拉手重复、错位,和两扇门的关系对不上。吧台也添了水槽、水龙头和其他小物,超过了咖啡机、两只白杯、一盆蕨类的要求。

图:左边是草图的双开门,右边是ChatGPT成图。门把手的数量和安装位置不合理。

右侧的问题更影响布局。原本沿窗留出的90厘米主通道,被它加进了一整组发光陈列柜。柜子挡住部分窗面,也占用了预留区域。透视图量不出通道还剩多少厘米,但草图中原本留空的位置,已经被放进了家具。

图:右侧新增的陈列柜,侵入了草图中的通道区域。这里只判断位置变化,不从透视图测算实际宽度。

三家的首轮结果留下后,我又把同一道题放到ChatGPT网页版补跑了一次。这张单独看,不替换前面的结果。

新图改善了不少:门把手看起来正常了,吧台上也正好是咖啡机、两只白杯和一盆蕨类,右侧通道比Codex版开阔得多。

图:ChatGPT网页版的补跑结果,不计入首轮24张图。门把手和吧台物品有改善,部分空间结构仍与草图不同。

但另一些地方又变了。左侧双开门更像一扇开启的单门,后墙六格书架扩成九格,双人桌周围多了椅子;右侧沿窗又添了一组书柜,仍挡住部分窗面。

另外两家的首轮图也各有偏差。Nano Banana 2画得漂亮,空间也完整,可后墙六格书架变成大面积书墙,门窗组合没照着草图来。即梦保留了主要区域,比例和六格书架也没守住。

四张里,我更愿意留下网页版补跑的那张继续改;只比三家的首轮结果,我仍选ChatGPT。只是门窗、书架和通道还得逐项核对,没有一张能直接当设计图。

05修完老照片,街边多了个车轮

最后一题用了约1925年的北京前门大街照片。画面从雕花牌楼下望向正阳门,前景有人力车、马车、早期汽车、行人和电线杆。原扫描来自美国国会图书馆。

为了知道它们到底修对了没有,我先用完整扫描制作一张受损版:降低对比度,加上褐色扫描感、灰尘、霉点、两道划痕和一条折痕,再遮掉右下角一块街景。

三家拿到的都只有受损版。完整原图D0先留在本地,等修复结果全部出来,再拿它核对缺掉的地方究竟是什么。

实际提示词是:

保守修复附件D:去除新增的灰尘、霉点、两道划痕和横向折痕,补全右下角,恢复自然的黑白层次、对比度和适度胶片颗粒。保持牌楼、城门、道路、车辆、行人、树木和路边构件的数量、位置与时代特征不变;不要影视化,不要新增现代物品、人物或文字。保持原画幅,只输出一张完整修复图。

图:上方为受损版和事后公开的完整原图D0,下方为三家修复结果。重点看右下角街景、车辆和边框编号。

ChatGPT补回的道路、树木、行人和路边石构件最接近原图,牌楼、城门与前景车辆的关系也最稳定。问题出在上边框:馆藏编号“137036”被一并清掉了,部分细节也有重绘。

即梦保住了编号,整体结构接近原图,但对比度和锐度提得更狠,车辆、人群的一些细节看着像重新画过。

Nano Banana 2修掉了损伤,却在右边补出一个大车轮,还添了街景。单看这张修复图,车轮出现在旧街道上似乎并不突兀;把原图拿出来,才发现那里根本没有它。

图:右下缺损区100%同位置对比。Nano Banana 2最右侧的大车轮在D0中不存在;ChatGPT补回的道路、树木与石构件关系更接近原图。

图:牌楼与上边框局部。即梦和Nano Banana 2保留了“137036”,ChatGPT的结果里,这组馆藏编号消失了。

这题我还是更喜欢ChatGPT的修复,但它也只是更接近原图。编号要保留,重绘过的细节也得再看,不能算无损恢复。

结尾:做完这轮,我会留下哪些图

局部改图和中文日程,我会选ChatGPT。草图还原、老照片修复,也是它最接近我想要的结果,只是还得继续检查和修改。海报要分开看:ChatGPT的首稿我更喜欢,改到第二轮,即梦反而更能保住原来的设计。

放到我平时写稿配图的场景里,我最在意的是图能不能对上文章要说的事。画得再精致,读者看不出它跟正文有什么关系,我也不会用。图里要写的字,最好不用我一处处再补;拿参考图改稿,原来满意的地方也希望能留下。ChatGPT那张中文日程连着改完还能直接用,这比一张单纯好看的图更对我的胃口。

即梦我也会继续试。青柚改白桃那一轮,它是三家里最守规矩的,只是浅粉色点缀还没补上。Nano Banana 2的咖啡馆效果图也够好看,找装修风格的话,我愿意把它当参考;但真要照着手里的草图往下做,门窗和书架还是得逐项核对。这几款工具,我会按具体的活挑,没必要选定一家以后,什么图都只用它。

不过看完这轮,最让我警惕的还是老照片里多出来的那个车轮。要是手里没有完整原图,它看起来完全可以是街景的一部分。

责任编辑:hnnew003
我要评论查看所有评论
昵称:

 遵守中华人民共和国有关法律、法规,遵守《互联网新闻信息服务管理规定》。

 尊重网上道德,承担一切因您的行为而直接或间接引起的法律责任。

 您在河南商报网发表的言论,我们有权在网站内转载或引用。

相关新闻

最近更新

版权与免责声明:

1 本网注明“来源:×××”(非河南商报)的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,本网不承担此类稿件侵权行为的连带责任。

2 在本网的新闻页面或BBS上进行跟帖或发表言论者,文责自负。

3 相关信息并未经过本网站证实,不对您构成任何投资建议,据此操作,风险自担。

4 如涉及作品内容、版权等其它问题,请在30日内同本网联系。

热文排行
  • 财经
  • 股票
  • 理财
  • 金融

河南商报网广告服务中心

广告热线: