模型IT之家AI资讯·原文 2026年9月5日

微软推出MAI-Image-2.6-Flash图像生成模型,称生图速度为GPT-Image-2-Medium两倍

微软在Microsoft Foundry平台开放自研图像生成模型的公开预览,定价大幅低于旗舰版MAI-Image-2.6,并声称GPU效率提升 72%。

AI解读:微软这次发布的MAI-Image-2.6-Flash,本质上是一款为速度和成本而优化的图像生成模型,想解决的是高延迟和高费用问题:它把图片输出价格从旗舰版的每百万token 38美元砍到 19 美元,文字输入从 5 美元降到 1.75 美元,同时保留对象移除、局部重绘等核心编辑功能。对高频调用图像API的开发者或企业来说,这意味着同样的预算能跑更多次请求,或者把这类功能从实验性场景挪到生产管线里。微软AI负责人苏莱曼称其生图速度是GPT-Image-2-Medium的 2 倍,GPU效率提升 72%——如果这些数字属实,对成本敏感的用户会有直接吸引力。但要注意,Flash版之所以便宜,本质是牺牲部分质量换来速度,微软自己也建议复杂编辑和高商业设计要求用旗舰版,所以它更适合内部快速出图、A/B测试或海量素材初筛,而不是交付给客户的最终作品。微软正在用价格梯度把不同需求拆开,让成本敏感和效果敏感的用户各取所需,但目前还没有第三方基准能验证其速度和效率声明,正式判断仍需实测。

微软于 9 月 4 日发布博文,宣布推出自研图像生成模型MAI-Image-2.6-Flash,并在Microsoft Foundry平台开放公开预览。微软称该模型生成图像的响应速度是GPT-Image-2-Medium的 2 倍,GPU效率提升 72%。

MAI-Image-2.6-Flash按每百万Token计费的API定价为:文字输入 1.75 美元(约合 11.8 元人民币),图片输入 2.50 美元(约合 16.8 元人民币),图片输出 19 美元(约合 127.8 元人民币)。相比之下,旗舰版MAI-Image-2.6的文字输入为 5 美元、图片输入为 8 美元、图片输出为 38 美元。

该模型与旗舰版MAI-Image-2.6共享文生图和图生图 / 图像编辑的核心能力,包括对象移除 / 替换、局部重绘、属性修改、文字更新等。微软称其仍保留MAI-Image-2.6的核心生成与编辑能力,仅重点优化了速度和成本。

微软建议的使用场景与性能声明

微软建议,对最终生产素材、复杂编辑、商业设计以及高图像质量和文字渲染要求的任务,应使用旗舰版MAI-Image-2.6;对延迟、吞吐量和成本更敏感的任务,则应使用MAI-Image-2.6-Flash。

微软AI负责人穆斯塔法·苏莱曼于 9 月 5 日发布推文称,相比GPT-Image-2-Medium,MAI-Image-2.6-Flash的生图速度是其 2 倍,GPU效率提高 72%。该推文引用的比较对象来自微软官方博文。

查看原图 · 1300 × 500

信息来源

IT之家AI资讯原始来源