微软发布MAI2.6图像生成模型,Arena榜单升至第二

当地时间8月10日,微软正式发布新一代文本生成图像模型 MAI-Image-2.6。该模型在 Arena 文本转图像榜单上跃居全球第二,仅次于 OpenAI 的 GPT-Image-2,在文字渲染、人像与 3D 图像生成方面较上一代明显提升。

微软 AI 部门负责人穆斯塔法·苏莱曼在社交媒体上发文称,MAI-Image-2.6 已成为全球排名第二的文本转图像模型,超越了 Google、Meta 与 xAI 等多款主流竞品。这也是微软继 MAI-Image-2.5-Pro 之后,在自研图像生成赛道上再一次提速。

榜单表现:超越多款主流竞品

据官方介绍,MAI-Image-2.6 在 Arena 文本转图像类别的综合评分比上一代 MAI-Image-2.5 高出 79 个 Elo 分,其中纯文字渲染单项得分提升 91 个 Elo 分。在 Arena 文字渲染专项榜单中,mai-image-2.6-preview 以 1374 分的成绩位列第 一,领先第二名的 mai-image-2.5(1284 分)约 90 分。

核心升级:文字、人像与 3D 图像

微软表示,MAI-Image-2.6 在三个方向上实现了针对性改进。图像内文字渲染更加精准,长句与复杂排版的还原度显著提升;人像生成在面部细节、光影与皮肤质感上更为自然;3D 图像的空间结构与材质表现也更扎实。官方同时强化了参考图像支持能力,用户可基于样例图片进行风格化生成,进一步降低上手门槛。

图:MAI-Image-2.6 在多个维度的能力提升

竞争格局:自研模型加速追赶

自微软将 MAI-Image 系列定位为对标 OpenAI GPT-Image 的自研产品线以来,迭代节奏明显加快。MAI-Image-2.5-Pro 发布后不久,MAI-Image-2.6 便快速跟进,并在第三方盲测榜单上直接超越 Google、Meta、xAI 等厂商的主力图像模型。分析认为,微软在 Office、Copilot 等场景中内置图像生成能力的需求,正在持续推动该系列模型快速迭代。

总结与展望

MAI-Image-2.6 的发布标志着微软在图像生成赛道上首次跻身全球第 一梯队。随着 Arena 盲测结果持续累积,该模型后续在 Copilot 与 Windows 生态中的落地节奏值得关注,同时也将加剧头部厂商在文生图能力上的竞争。

展开阅读全文

更新时间:2026-08-14

标签:科技   模型   图像   微软   文本   文字   能力   人像   全球   赛道   化生

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号

Top