数码影音频道 频道

微软发布MAI-Image-2.6图像生成模型,Arena榜单升至第二

“AI摘要”

微软于8月10日发布新一代文本生成图像模型MAI-Image-2.6,在Arena榜单上跃居全球第二,仅次于OpenAI的GPT-Image-2。该模型综合评分较前代提升79个Elo分,文字渲染单项得分1374分排名第 一。核心升级包括更精准的文字渲染、自然的人像生成和扎实的3D图像表现,并强化了参考图像支持。这是微软继MAI-Image-2.5-Pro后的快速迭代,直接超越Google、Meta和xAI等竞品,标志着其首次跻身全球第 一梯队。未来其在Copilot和Windows生态中的落地值得关注。

当地时间8月10日,微软正式发布新一代文本生成图像模型 MAI-Image-2.6。该模型在 Arena 文本转图像榜单上跃居全球第二,仅次于 OpenAI 的 GPT-Image-2,在文字渲染、人像与 3D 图像生成方面较上一代明显提升。

微软 AI 部门负责人穆斯塔法·苏莱曼在社交媒体上发文称,MAI-Image-2.6 已成为全球排名第二的文本转图像模型,超越了 Google、Meta 与 xAI 等多款主流竞品。这也是微软继 MAI-Image-2.5-Pro 之后,在自研图像生成赛道上再一次提速。

榜单表现:超越多款主流竞品

据官方介绍,MAI-Image-2.6 在 Arena 文本转图像类别的综合评分比上一代 MAI-Image-2.5 高出 79 个 Elo 分,其中纯文字渲染单项得分提升 91 个 Elo 分。在 Arena 文字渲染专项榜单中,mai-image-2.6-preview 以 1374 分的成绩位列第 一,领先第二名的 mai-image-2.5(1284 分)约 90 分。

  • 综合评分:较 MAI-Image-2.5 提升 +79 Elo 分

  • 文字渲染:较 MAI-Image-2.5 提升 +91 Elo 分

  • 文字渲染榜:mai-image-2.6-preview 得分 1374,排名第 一

  • 整体定位:文本转图像全球第二,仅次于 GPT-Image-2

 

核心升级:文字、人像与 3D 图像

微软表示,MAI-Image-2.6 在三个方向上实现了针对性改进。图像内文字渲染更加精准,长句与复杂排版的还原度显著提升;人像生成在面部细节、光影与皮肤质感上更为自然;3D 图像的空间结构与材质表现也更扎实。官方同时强化了参考图像支持能力,用户可基于样例图片进行风格化生成,进一步降低上手门槛。

图:MAI-Image-2.6 在多个维度的能力提升

竞争格局:自研模型加速追赶

自微软将 MAI-Image 系列定位为对标 OpenAI GPT-Image 的自研产品线以来,迭代节奏明显加快。MAI-Image-2.5-Pro 发布后不久,MAI-Image-2.6 便快速跟进,并在第三方盲测榜单上直接超越 Google、Meta、xAI 等厂商的主力图像模型。分析认为,微软在 Office、Copilot 等场景中内置图像生成能力的需求,正在持续推动该系列模型快速迭代。

总结与展望

MAI-Image-2.6 的发布标志着微软在图像生成赛道上首次跻身全球第 一梯队。随着 Arena 盲测结果持续累积,该模型后续在 Copilot 与 Windows 生态中的落地节奏值得关注,同时也将加剧头部厂商在文生图能力上的竞争。

0
相关文章