OpenAI的图像生成能力可能又要往前迈一大步了。最近有消息显示,这家公司正在准备发布下一代图像模型的升级版本,内部代号疑似为ImageGen 2.5。虽然官方还没正式官宣,但蛛丝马迹已经藏不住了。
藏在代码里的"彩蛋"
最先发现端倪的是眼尖的开发者。有人在ChatGPT的代码里发现了一个隐藏的模态框,里面赫然写着"图像创作迎来重大升级"(Image creation got a major upgrade),还附带了三项具体描述:更高质量的生成结果、更快的生成速度,以及更智能的创作工具。这段文字被硬编码在Codex相关的代码中,看起来像是为某个新功能预埋的公告文案。
更耐人寻味的是,这个模态框虽然已经内置在代码里,但开关并没有对普通用户开放——也就是说,功能已经就位,只是还没到放行的时候。有人猜测,这可能是OpenAI在为新版本上线做最后的准备。
测试痕迹早已暴露
其实在这段代码被发现之前,OpenAI就已经被注意到在Image Arena这个图像模型评测平台上测试新的图像模型。Image Arena是一个社区驱动的盲测平台,用户看不到模型名称,只能根据生成结果打分。OpenAI悄悄把新模型放上去跑分,显然是想在正式发布前摸摸底,看看它在真实用户眼里的表现到底如何。
结合这次代码里泄露的文案,几乎可以断定:这个正在测试的新模型,就是传闻中的GPT-Image-2.5。从命名规律来看,它应该是现有图像模型的一次中期升级,而不是彻底换代——但"更高质量、更快生成、更智能工具"这三点,恰好戳中了当前图像生成最核心的三个痛点。
一张9月1日上传的"英雄图"
另一个值得注意的细节是,与这段隐藏代码关联的"英雄图"(Hero Image)上传时间是9月1日。所谓英雄图,通常是指产品发布页顶部那张最显眼的主视觉图。这张图已经提前上传,说明发布物料正在准备中,距离正式公开可能不会太远。
从时间线来看,9月1日上传物料,9月3日代码被扒出,节奏相当紧凑。如果OpenAI按惯例走,接下来几天内随时可能官宣。当然,也不排除他们发现代码泄露后临时调整发布计划——毕竟这家公司向来喜欢"惊喜"。
这次升级意味着什么?
如果ImageGen 2.5真的如泄露文案所说,把生成质量、速度和创作工具三个维度同时拉高,那对创作者来说是个实打实的利好。尤其是"更智能的创作工具"这一条,暗示的可能是更强的指令理解能力,或者更精细的区域编辑功能——这些都是目前图像生成工具被吐槽最多的地方。
不过话说回来,OpenAI的"即将发布"有时候是几天,有时候是几个月。代码泄露只能说明功能已经开发完毕,但上线节奏完全取决于内部决策。对于普通用户来说,现在能做的只有一件事:盯着ChatGPT的更新日志,等那个模态框真正弹出来。
图像生成赛道又要热闹了。这次OpenAI能拿出什么新东西,值得期待。
热门跟贴