微软9月正式推出自主研发图像生成模型的轻量化变体 MAI-Image-2.6-Flash,并已通过 Microsoft Foundry 开启公开预览。作为上月登顶技术榜单前列的 MAI-Image-2.6的高效率版本,该模型的推出标志着微软在AI图像生成领域全面展开对高并发、低延迟及成本敏感型工业级应用场景的布局。
测试数据显示,MAI-Image-2.6-Flash 的图像生成速度达到 GPT-Image-2-Medium 的2.8倍,整体综合效率提升达72%。在大幅削减推理延迟与计算开销的同时,该变体完整继承了主模型的核心生成与编辑能力,支持高精度的文本到图像生成以及局部对象级图像编辑。

此外,MAI-Image-2.6系列整体带来了多项架构级升级,包括支持最多5张参考图以保障多图角色与产品的一致性、集成 Bing 搜索的网络定位功能以补充现实世界图像信息,并新增对动态宽高比和更高分辨率输出的原生支持。
在商业化定价策略上,Flash 版本将文本输入、图像输入和图像输出的每百万 Token 价格分别下探至1.75美元、2.50美元和19美元,较主模型实现了超过50%的显著降本。
微软官方建议将主模型应用于对画质和文本渲染要求苛刻的商业设计与最终生产资产,而将 Flash 版本精确定位于交互式应用、快速创意迭代以及大规模自动化流程。这一兼顾极端性能与极致性价比的多模态模型矩阵,反映出当前生成式AI从单一技术突破向高吞吐量、低成本工程化落地演进的行业趋势。