打开网易新闻 查看精彩图片

大家好,我是李飞。

OpenAI 在 9 月 8 日发布了 Image 2.5。这次更新提到了更快的生成速度,也强调了精细编辑和连续修改时的一致性。来源:OpenAI 发布公告

这些变化,放到具体图片里会是什么样?

我做了三组测试:先在网页端把白天街拍改成雨后夜景,再让骑车的人动起来;另外两组用 Codex,把几根粗线条变成船坞里的巨型机械鲸,再让一只狗先穿上宇航服、去到月球,接着改配色、加旗帜,连续修改四轮。

下面我们来实测一下。

01 白天变雨夜,再让骑车的人动起来

第一组,我拿一张真实的香港街拍来改。旧墙、空调、晾着的衣服,下面是三家小店。路面还是干的,一个人跨着自行车,停在店门口。原图:Armand M / Pexels

打开网易新闻 查看精彩图片

先把它交给网页端的 ChatGPT,改成雨刚停的夜晚。

提示词:

把这张街拍改成雨刚停的夜晚,保留原来的构图、建筑、招牌文字、人物和车辆。用店铺里原有的灯照亮门口,湿润的柏油路上出现自然、断续的灯光反射,保留路面纹理,不要像镜子一样。旧墙、晾着的衣服、杂乱的货物和楼上的暗部都保留下来。整体像摄影师在同一个地方拍到的真实夜景,灯光克制,不加霓虹、电影滤镜、夸张光晕和雾气。

打开网易新闻 查看精彩图片

改完是这样:

打开网易新闻 查看精彩图片

天黑了,店里的灯亮了,白光和暖光映到了湿路上。车身上的反光也跟着变,楼上的墙面则暗了下来。

原来的三块大招牌、窗户和晾衣绳,还能和白天那张对应上。它得把这一条街的光一起改过来,光把照片调暗可不够。

还有一点我感受挺明显:2.5 改完的图,看着干净了不少。

之前用 2.0 改图,我会觉得画面像蒙了一层脏脏的小点。这次用 2.5 改,那种明显的脏点感基本没有了。

我又接着提了个要求:让这个人骑起来,带一点拍照时的拖影。

这种效果叫慢门运动模糊。这里要的是人动起来有点糊,后面的店铺还是清楚的。

提示词:

在这张雨后夜景上继续修改:让原来坐在自行车上的人开始踩踏板,沿着车头朝向向前骑行,身体自然微微前倾。拍成固定机位、慢门曝光的感觉:人物和自行车带一点沿移动方向的运动模糊,身后有短而淡的拖影,脚部和转动的车轮稍微模糊,但仍然能看清是同一个人在骑车。背景建筑、店铺和招牌保持清楚,整体构图和夜景灯光保持不变。效果自然、轻微,像真实街头抓拍,不要出现多个完整人影,也不要漫画速度线。

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

人从原来停着的姿势变成了身体前倾,手扶车把往前骑。人和车轮带着一点模糊,后面的招牌却没有一起糊掉,上一轮的夜景和湿路面也还在。

先把白天改成雨夜,再只改骑车人的动作,前面改好的灯光还能接着留下来。 这样对着两张图看,连续改图的作用就直观多了。

不过,仔细看店里的小字和商品包装,还是有些变化,大体保住了场景不等于每个细节都原封不动。

02 几根粗线条,变成船坞里的机械鲸

第二组想看的是:给它一个很简略的构图,它能不能沿着这个构图往下画?

测试输入是一张 AI 生成的粗线稿。画面里只有鲸鱼轮廓、船坞边界、三条吊索,以及左下角的一个小人。

打开网易新闻 查看精彩图片

我让 Codex 根据这张图,补成写实电影场景。

提示词:

保留主体的位置、比例和朝向:机械鲸头朝右、尾朝左,三条吊索连接屋顶与鲸背,左下角的人穿黄色雨衣。鲸鱼使用深蓝金属、黄铜关节和透明舷窗,旧船坞里有薄雾、晨光与地面积水。

这是第一次生成的结果:

打开网易新闻 查看精彩图片

粗线稿里的位置关系,在成图中都找得到:鲸鱼仍然朝右,三条主要吊索连着上方结构,左下角的人把鲸鱼的体积衬托了出来。

金属外壳、舷窗、屋顶透下来的光和地面反射,则把几根线条补成了一个有重量感的场景。

画面一下丰富了很多,鲸鱼和左下角的小人也没有乱跑位置。 想让它按自己的想法画,可以先把大概的位置和大小画出来,细节再让它补。

打开网易新闻 查看精彩图片

上面的鲸鱼肯定不是我手绘的,哈哈哈,我让 GPT 自己生成的手绘稿。

手残党只会用固定的形状拼,下面这个是我自己画出来的。

打开网易新闻 查看精彩图片

提示词也很简单:

根据草图生成一个动物卡通形象。

生成出来是这样的:

打开网易新闻 查看精彩图片

再看这个 UFO,也是用简单的形状拼出来的。

打开网易新闻 查看精彩图片

这次的提示词是:

一个UFO 向地球发送爱心个光波攻击。科幻电影风。

打开网易新闻 查看精彩图片

生成速度确实感觉快不少。

PS:我测试的时候,Codex 里还不能使用手绘板,我是在网页端测试的。

03 连续改图实测:同一张图接着改四轮

接下来,我拿同一张图连续改四次。每次都拿刚改好的那张,接着往下改。

原照 → 第 1 轮:穿宇航服 → 第 2 轮:换月球背景 → 第 3 轮:控制盒改绿 → 第 4 轮:加黄色小旗。

我用 OpenAI 公开示例中的宠物原照作输入。照片里是一只浅奶油色卷毛狗,站在露台上,旁边能看到椅子、牵引绳和人的鞋子。原照来源:OpenAI

第 1 轮:只换衣服,保留露台背景。

提示词:

给同一只狗穿上白色宇航服,戴透明头盔,胸前加橙色控制盒,左肩加蓝色圆形徽记。保留面部特征、四脚站立姿势、拍摄角度和露台背景。

官方输入原照

本次第一轮:穿宇航服

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

第一轮里,宇航服和指定的两个小配件都出现了,背景里的椅子、鞋子和牵引绳也还在。

第 2 轮:换成月球背景,保留上一轮的宇航服。

我把刚生成的宇航服版本作为这一轮的输入,继续改环境。

提示词:

把环境换成月球表面,远处是黑色天空和蓝色地球。移除露台、椅子、人的裤腿与鞋子、牵引绳。保留上一张图的小狗、站姿、白色宇航服,尤其保留橙色控制盒、蓝色肩章和透明头盔。

打开网易新闻 查看精彩图片

第二轮里,露台上的物体被移除了,场景换成了月面;橙色控制盒、蓝色肩章、头盔和四脚站立的姿势仍然保留。

接着继续往下改,这次把修改范围缩小到一个局部。

第 3 轮:只把橙色控制盒面板改成绿色。

提示词:

只把胸前控制盒的橙色面板改成草绿色,保留银色外框、一个大圆按钮和右侧三个小圆按钮。小狗、宇航服、肩章、头盔、月球背景和地球位置保持不变。

打开网易新闻 查看精彩图片

这轮里,面板颜色改了,按钮的数量和排列还在。蓝色肩章、头盔和右上角的地球,也能与上一张对应。

第 4 轮:增加小旗,检查绿色面板能不能留住。

我把第三轮的绿色面板版本继续交给它。

提示词:

只在小狗左后方增加一面黄色小旗,上面写黑色大写 LIFEI。不要遮挡小狗或地球。保留上一轮的绿色面板、银色边框、四个黑色按钮、蓝色肩章和透明头盔,不要把面板恢复成橙色。

打开网易新闻 查看精彩图片

黄色小旗出现了,LIFEI 的字母也正确。更值得看的是胸口:上一轮刚改的绿色保留了,没有因为这一轮加旗,又回到原来的橙色。 白色宇航服、蓝色肩章和透明头盔也还在。

这组图能直接看到四轮修改如何累积:衣服定下来,再换场景;场景定下来,再调局部颜色,最后补一个物体。

不过,仔细看也能发现,小狗脸上的毛和原照有些区别。后面接着改,衣服褶皱和地上的纹理也有变化。要是做固定角色或者商品图,这些地方还是得自己看一眼。

04 速度快了多少?看一组公开对照

看完成图,再回到发布信息里的另一个变化:速度。

OpenAI 表示,相比 Images 2.0,Image 2.5 的图像生成延迟最多降低 50%。来源:OpenAI

12ui 的公开对比提供了一个具体样本。在同一个电影作品集 UI 任务里,同样选择 medium 质量档位,页面记录如下:

模型

生成耗时

单次费用

Image 2

50.7 秒

约 0.074 美元

Image 2.5 Flare

18.7 秒

约 0.044 美元

Image 2.5 Sunburst

20.9 秒

约 0.044 美元

这个样本里,Flare 从接近一分钟缩短到了不到二十秒。不过,每个条件只有一张样本,不能当成所有任务的平均速度;生成的也是界面图片,并非可操作的网站。来源:12ui 公开对比

05 怎么开始用

官方公告称,这次更新开始向 ChatGPT、ChatGPT Work 和 Codex 的各档用户推送,具体入口以账号实际收到的更新为准。

我这次也在网页端完成了手绘测试,具体入口以实际界面为准。如果当前界面没有 Sketch 选项,可以像前面的机械鲸测试一样,直接上传草图作为图片参考,再描述希望生成的效果。

如果通过 API 调用,可以按任务选择:

  • Flare

    更侧重速度,适合快速试方案。

  • Sunburst

    更侧重编辑精度,适合细节要求更高的任务。

两款模型的 Token 单价与 Image 2 相同,但每张图消耗的 Token 会变化,实际费用还要看尺寸、质量档位和具体任务。来源:Flare 模型页、Sunburst 模型页

这几组图做下来,生图更快、改完更干净,确实是我能感受到的变化。能把刚做好的图拿回来继续改,也让“先试试看”这件事轻松了不少。

就像前面那张街拍,先改成雨夜,再让骑车的人动起来。第一张出来以后,才想到下一步要怎么改,也完全来得及。

如果你也想试试,可以直接找一张相册里的照片,先换个光线,或者改一下人物动作。不会画画,就像我一样,用几个简单的形状拼一张草图。

毕竟我那只企鹅的手绘水平,你们也看到了,哈哈哈。画得糙一点没关系,先把想法放上去,剩下的再边看边改。