快速了解本文
微软发布 MAI-Image-2.6-Flash,生图速度达 GPT Image 2 的两倍。
模型支持完整图像编辑功能,GPU 效率提升 72%。
相比竞品显著降低成本,大规模生成每月可节省数十万美元。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 2026 年 9 月 4 日,微软发布自研图像生成模型 MAI-Image-2.6-Flash,通过 Microsoft Foundry 开放公开预览。微软 AI 负责人 Mustafa Suleyman 表示,该模型生图速度是 GPT Image 2 的 2 倍,GPU 效率提高 72%;官方博文对比 GPT-Image-2-Medium 甚至达到 2.8 倍速度提升。这是微软 AI 部门在 Suleyman 领导下推出的第一方基础模型,标志着微软在图像生成领域开始建立自主技术体系。
该模型生图速度是 GPT Image 2 的 2 倍,GPU 效率提高 72%。
MAI-Image-2.6-Flash 与旗舰版 MAI-Image-2.6 共享相同的文生图和图生图核心能力,支持对象移除与替换、局部重绘、属性修改、文字更新等完整图像编辑功能。模型采用流匹配技术(Flow Matching),拥有 200 亿参数,支持 32K Tokens 上下文窗口,使噪声向量以近乎直线方式映射到目标影像空间,大幅减少推论步数。在 Artificial Analysis 影像编辑榜中,MAI-Image-2.6-Flash 排名全球第 3(Elo 1311),仅次于 MAI-Image-2.6 和 GPT-Image-2 (high),击败 Google Nano Banana 2。开发者可通过 Azure AI Foundry、MAI Playground 和 OpenRouter 等平台调用 API。
关键数据
API 定价方面,MAI-Image-2.6-Flash 文字输入 1.75 美元/百万 Token,图片输入 2.50 美元/百万 Token,图片输出 19 美元/百万 Token,每千张图片约 19.50 美元。相比旗舰版 MAI-Image-2.6(图片输出 38 美元/百万 Token)和 GPT-Image-2(每千张约 165-210 美元)显著降低。对于跨境电商、数字营销等需要大规模图像生成的企业,以每日生成 10 万张图片为例,相比 GPT-Image-2 每月可节省约 45 万美元成本,同时生成延迟减半。

