出品 | 网易智能
作者 | 小扣
编辑 | 王凤枝
9月8日,OpenAI发布ChatGPT Images 2.5,向ChatGPT、ChatGPT Work和Codex用户开放。除了复杂版式和草图转图片,这次官方重点介绍了精确编辑:参考图里的主体能保留得更好,连续修改也更一致。公司还称,生成延迟较Images 2.0最高降低50%。
看完介绍,我更好奇的是:Images 2.5这次能不能和Nano Banana 2、即梦拉开差距?真拿来做海报、排日程、出效果图,哪家的成品更值得留下,哪些地方还得自己动手改?
于是,我在Codex里用ChatGPT Images 2.5,又找来Gemini里的Nano Banana 2和即梦图片5.0 Pro,做同样的五道题:连续修照片、做商品海报、排中文日程、把店铺草图变成效果图,再修复一张真实老照片。
每个平台提交八次,共留下24张用于比较的结果。提示词、附件顺序和画幅要求相同,连续编辑留在同一个对话里,每轮只取第一次结果,不因为“不够好看”重新抽卡。
五道题做完,四道里我更愿意留下ChatGPT的版本。但它也没少自作主张:海报只让换口味,整瓶水都跟着变粉;咖啡馆效果图看着不错,放大才发现门把手不对。
01换外套、拿杯子,其他地方别动
先从一张室内人物图开始。一个人穿着藏蓝色外套,坐在墨绿色扶手椅上,旁边蹲着一只橘猫。桌上放着红色马克杯、白色台灯和一本打开的书,背景还有两幅墙画和一扇窗。
我让三家分两步改:先把外套换成米白色,再从改好的图里拿走杯子。脸、头发、双手、猫和家具都得留住,构图与光线也不能变。
T01原始输入
第一轮提示词是:
只把人物的藏蓝色外套改成米白色。人物的脸、发型、表情、姿势和手,橘猫、家具、杯子、书、墙画、窗户、构图和光线全部不变;不要增删其他物体,保持原图尺寸。
图:第一轮只改外套颜色,可以对照原图看人、猫和房间有没有变化。
第一轮都做成了。外套换了颜色,人物、猫、家具和主要构图也都在。放大看,ChatGPT与原图最贴近,Nano Banana 2和即梦略有重绘感,但还在可以接受的范围内。
我又接着让它们拿走杯子。这一步得在刚才的结果上做,不能把外套变回藏蓝色:
在上一张结果上只移除红色马克杯,并自然补全桌面。米白色外套和其余内容全部保持不变。
图:第二轮移除杯子,米白色外套要保留。这里比较的是可见变化,没有做逐像素检查。
三家都拿走了杯子,外套颜色也没有退回去。两轮看下来,我会留ChatGPT这一份,其他地方没有明显被一起“翻新”。这一题的差别不大,另外两家的结果也能用。
02青柚换白桃,整瓶水都变粉了
海报这题,我准备了一个虚构品牌“山岚气泡水”,同时给出三份素材:产品正面、产品侧面与纸箱,以及一张品牌小规范。
先做一张4:5的青柚味新品海报,再把它改成白桃味。第二次修改只准换口味、两片水果和点缀色,版式、机位、光线都不能动。我想看的是,第一张做得满意之后,能不能接着用它改出同系列的下一张。
图:三家拿到的素材相同。产品、包装和品牌规范均为程序绘制的虚构素材,不是参赛模型的输出。
第一轮提示词是:
用附件B1–B3制作一张4:5中文新品海报。瓶身和Logo不得变形;画面只能出现“山岚气泡水”“青柚味”“0糖0脂0能量”“9月限定”四组文字。使用品牌墨绿色和暖白色,表现玻璃瓶、水珠、青柚和纸箱的真实材质,不要增加价格、英文、二维码或额外功效。
图:青柚版首稿,留意产品材质、文字位置,以及纸箱上的信息。
只看首稿,我最喜欢ChatGPT。标题、产品和卖点的层级清楚,玻璃、水珠、水果和纸箱也有质感,更像一张可以交给设计师继续收尾的广告。Nano Banana 2的材质感不差,但右侧卖点挤到了边缘;即梦比较简洁,纸箱却沿用了素材里的“12瓶装”,超出了指定的四组文字。
接下来改成白桃味。这次只给了一句要求:
只把“青柚味”改成“白桃味”,青柚换成两片白桃,点缀色改为浅粉色。Logo、瓶身、其他文字、版式、机位和光线不变。
图:白桃版二次修改。和上一张对照,瓶盖、液体、包装颜色与水果数量的变化都很明显。
ChatGPT这次改得有点多。瓶盖、瓶中液体、纸箱侧面和圆形徽章一起变粉,还加了整桃和额外桃块,没守住“两片白桃”的要求。Nano Banana 2也把瓶盖和液体改了色,桃肉不止两片。
即梦反而最接近“只改我说的地方”:原版式和产品机位保留得好,水果数量也最接近要求。但它又少做了一步,浅粉色点缀几乎没加上。
这题选不出一个全程最好的。ChatGPT首稿更像成品,即梦第二次修改更克制,三家都还有没改对的地方。
03临时改一场,别把整天的日程弄乱
AI作图的用途已经不只是配一张好看的插图,也包括海报、产品介绍这类需要承载大量文字的材料。信息一多,内容要写全、写对,还得让人容易找到重点;临时修改时,也不能把其他地方一起改乱。我用一张中文活动日程来试试。
这一题不提供参考图,只给九行中文日程和一行页脚,让模型自己排版。要求读者三秒内能找到午餐、下午第一场和结束时间,所有文字原字原序保留。做完之后,再临时调整14:10这一场。
第一轮提示词的重点是:
制作一张16:9中文日程信息图,标题为“2026 AI体验营|一日议程”。所有日程文字必须原字原序保留;让读者三秒内找到午餐、下午第一场和结束时间;不要加Logo、英文、二维码或新内容。
图:同一份排期生成的三张日程图,可以逐行核对时间、地点和讲者。
ChatGPT把九行日程和页脚都写对了,午餐、下午第一场和结束时间也容易找。即梦主体信息基本完整,只是又加了一个“2026”胶囊标签。
Nano Banana 2的问题更明显:13:10这一场重复了,其中一条活动名被截断,地点也写错。同一个时段多出一场活动,这张图就没法直接发出去。
第二轮,我只让它们改14:10–15:00这一场,活动名换成“智能体安全演练”,讲者换成“周禾”:
只修改14:10–15:00这一场:活动名改为“智能体安全演练”,讲者改为“周禾”,地点仍是“B2厅”,旁边增加“场地不变”橙色标签。其他内容和版式不变。
图:修改14:10这一场之后,ChatGPT保住了其余排期,Nano Banana 2也保留了第一轮的重复错误。
ChatGPT改好了指定场次,其他内容和版式没有明显变化。Nano Banana 2也完成了这次替换,但13:10那两条还在。这道题,我会直接留下ChatGPT的版本。
04草图变效果图,漂亮不等于照图施工
接着试一间社区书店咖啡馆。我给出一张俯视草图,把布局先定下来:左边是双开玻璃门,右边两扇落地窗,中间是L形吧台,后墙六格书架,左前方放双人桌,右侧留出90厘米主通道,相机位置也标好了。
模型可以发挥的是材质和傍晚的光线。门窗、桌子和走道已经有了位置,不需要再替我设计一遍。
实际提示词是:
严格按附件C的门窗、吧台、书架、桌子、通道和机位,生成一张16:9写实的傍晚社区书店咖啡馆。材质用胡桃木、暖白石材、拉丝不锈钢和磨砂玻璃,室内暖光、窗外蓝调;吧台只放咖啡机、两只白杯和一盆蕨类。不要加人物,不要改变门窗数量或堵住通道;成图不要保留草图文字和标线。
图:上方是草图,下方是三家效果图。先看门窗、吧台、书架和桌子能不能一一对上。
第一眼看,ChatGPT最接近草图。门窗、后墙书架、L形吧台和双人桌都容易找到,傍晚的气氛也有了。
放大之后,问题才冒出来。左侧双开玻璃门上,多根金属拉手重复、错位,和两扇门的关系对不上。吧台也添了水槽、水龙头和其他小物,超过了咖啡机、两只白杯、一盆蕨类的要求。
图:左边是草图的双开门,右边是ChatGPT成图。门把手的数量和安装位置不合理。
右侧的问题更影响布局。原本沿窗留出的90厘米主通道,被它加进了一整组发光陈列柜。柜子挡住部分窗面,也占用了预留区域。透视图量不出通道还剩多少厘米,但草图中原本留空的位置,已经被放进了家具。
图:右侧新增的陈列柜,侵入了草图中的通道区域。这里只判断位置变化,不从透视图测算实际宽度。
三家的首轮结果留下后,我又把同一道题放到ChatGPT网页版补跑了一次。这张单独看,不替换前面的结果。
新图改善了不少:门把手看起来正常了,吧台上也正好是咖啡机、两只白杯和一盆蕨类,右侧通道比Codex版开阔得多。
图:ChatGPT网页版的补跑结果,不计入首轮24张图。门把手和吧台物品有改善,部分空间结构仍与草图不同。
但另一些地方又变了。左侧双开门更像一扇开启的单门,后墙六格书架扩成九格,双人桌周围多了椅子;右侧沿窗又添了一组书柜,仍挡住部分窗面。
另外两家的首轮图也各有偏差。Nano Banana 2画得漂亮,空间也完整,可后墙六格书架变成大面积书墙,门窗组合没照着草图来。即梦保留了主要区域,比例和六格书架也没守住。
四张里,我更愿意留下网页版补跑的那张继续改;只比三家的首轮结果,我仍选ChatGPT。只是门窗、书架和通道还得逐项核对,没有一张能直接当设计图。
05修完老照片,街边多了个车轮
最后一题用了约1925年的北京前门大街照片。画面从雕花牌楼下望向正阳门,前景有人力车、马车、早期汽车、行人和电线杆。原扫描来自美国国会图书馆。
为了知道它们到底修对了没有,我先用完整扫描制作一张受损版:降低对比度,加上褐色扫描感、灰尘、霉点、两道划痕和一条折痕,再遮掉右下角一块街景。
三家拿到的都只有受损版。完整原图D0先留在本地,等修复结果全部出来,再拿它核对缺掉的地方究竟是什么。
实际提示词是:
保守修复附件D:去除新增的灰尘、霉点、两道划痕和横向折痕,补全右下角,恢复自然的黑白层次、对比度和适度胶片颗粒。保持牌楼、城门、道路、车辆、行人、树木和路边构件的数量、位置与时代特征不变;不要影视化,不要新增现代物品、人物或文字。保持原画幅,只输出一张完整修复图。
图:上方为受损版和事后公开的完整原图D0,下方为三家修复结果。重点看右下角街景、车辆和边框编号。
ChatGPT补回的道路、树木、行人和路边石构件最接近原图,牌楼、城门与前景车辆的关系也最稳定。问题出在上边框:馆藏编号“137036”被一并清掉了,部分细节也有重绘。
即梦保住了编号,整体结构接近原图,但对比度和锐度提得更狠,车辆、人群的一些细节看着像重新画过。
Nano Banana 2修掉了损伤,却在右边补出一个大车轮,还添了街景。单看这张修复图,车轮出现在旧街道上似乎并不突兀;把原图拿出来,才发现那里根本没有它。
图:右下缺损区100%同位置对比。Nano Banana 2最右侧的大车轮在D0中不存在;ChatGPT补回的道路、树木与石构件关系更接近原图。
图:牌楼与上边框局部。即梦和Nano Banana 2保留了“137036”,ChatGPT的结果里,这组馆藏编号消失了。
这题我还是更喜欢ChatGPT的修复,但它也只是更接近原图。编号要保留,重绘过的细节也得再看,不能算无损恢复。
结尾:做完这轮,我会留下哪些图
局部改图和中文日程,我会选ChatGPT。草图还原、老照片修复,也是它最接近我想要的结果,只是还得继续检查和修改。海报要分开看:ChatGPT的首稿我更喜欢,改到第二轮,即梦反而更能保住原来的设计。
放到我平时写稿配图的场景里,我最在意的是图能不能对上文章要说的事。画得再精致,读者看不出它跟正文有什么关系,我也不会用。图里要写的字,最好不用我一处处再补;拿参考图改稿,原来满意的地方也希望能留下。ChatGPT那张中文日程连着改完还能直接用,这比一张单纯好看的图更对我的胃口。
即梦我也会继续试。青柚改白桃那一轮,它是三家里最守规矩的,只是浅粉色点缀还没补上。Nano Banana 2的咖啡馆效果图也够好看,找装修风格的话,我愿意把它当参考;但真要照着手里的草图往下做,门窗和书架还是得逐项核对。这几款工具,我会按具体的活挑,没必要选定一家以后,什么图都只用它。
不过看完这轮,最让我警惕的还是老照片里多出来的那个车轮。要是手里没有完整原图,它看起来完全可以是街景的一部分。
热门跟贴