OpenAI在9月9日发布了ChatGPT Images 2.5,官方称这是目前最先进的图像生成模型。相比2026年4月推出的Images 2,新版本把图像生成延迟最多降低了50%,同时在细节锐度、自然光照和纹理丰富度上都有提升。

Sketch草图功能上线

打开网易新闻 查看精彩图片

这次更新最显眼的是Sketch功能。用户在对话中输入“@Sketch”就能调用,直接在对话里画草图,再补充风格和细节描述,模型会把草图转成完整图像。这个路径省去了来回切换工具的麻烦,对需要快速验证想法的创作者比较友好。

产品还新增了海报、商品等常见创作格式的模板,降低上手门槛。用户可以直接在图像上添加批注,聚焦具体修改区域,分享图像时还能附带原始提示词。图片内评论功能允许用户标注位置并发出“删除此区域”或“将此改为蓝色”这类指令,模型只改指定区域,其余部分保持不变。多轮编辑过程中,模型能更好保持图像一致性和质量,避免多次编辑后细节退化。

API提供两款模型

API调用方面,OpenAI提供了两款模型:

  • GPT-Image-2.5 Flare:面向多数API图像生成应用,适用于创作者内容、社交内容、产品体验、视觉搜索、快速原型和高批量生成等场景。
  • GPT-Image-2.5 Sunburst:面向对编辑控制要求更高的工作流,OpenAI建议用于成品级营销素材和精修产品图等场景,但生成时间更长。

API支持多种分辨率,包括1024×1024、2048×2048、3840×2160(4K横向)等,单边最长不超过3840像素,总像素数介于655,360至8,294,400之间。

定价与安全机制

价格方面,两款模型定价一致:图像输入每百万token 8美元,缓存输入2美元,输出30美元;文本输入5美元,缓存输入1.25美元。安全和合规上,Images 2.5延续现有安全机制,对提示词和生成图像实施检查以防止有害输出。所有输出均嵌入C2PA元数据和隐形水印,便于识别由OpenAI工具生成的图像,打击未授权复用或深度伪造。