Microsoft AI近日在官方博客宣布,其最新图像生成模型 MAI-Image-2.6 在 Arena 文生图(text-to-image)排行榜上位列第二,排名领先于 Google、Meta 和 xAI 的同类模型。榜首仍为 OpenAI 的 GPT-Image-2。

打开网易新闻 查看精彩图片

相较上一代 MAI-Image-2.5,新模型整体 Elo 评分提升 79 分,且在 Arena 所有文生图类别中均有改善,其中文字渲染(text rendering)单项提升达 91 Elo。根据 Arena 8 月初的榜单数据,MAI-Image-2.5 此前位列第六,此次跃升标志着微软与 OpenAI 之间的差距进一步收窄。

从迭代路径看,MAI-Image 系列呈现稳定的版本爬坡态势:初代 MAI-Image-1 奠定基础,MAI-Image-2 在照片真实感与文字渲染上实现大幅跨越,2.5 版进一步向专业级图像与编辑能力推进。MAI-Image-2.6 延续这一势头,在文字渲染、人像与 3D 图像、商业及照片级输出(涵盖产品、品牌与影视用例)等类别上均带来明显增益。

打开网易新闻 查看精彩图片

微软同时透露,MAI-Image-2.6 还将支持多参考图输入、更丰富的 grounding 能力,以及对推理、格式和分辨率的更强控制,相关细节将于后续公布。这与微软上个月发布 MAI-Image-2.5-Pro 时强调的策略一脉相承——以自研模型驱动自有产品,从 Bing Image Creator 到 PowerPoint 均已逐步切换至 MAI 系列。

目前 MAI-Image-2.6 已可在 Arena 上体验,本周晚些时候将登陆 MAI Playground,并陆续推广至 Microsoft Foundry 及其他微软产品。