微软于9月正式发布其自研图像生成模型 mai-image-2.6 的轻量级版本——mai-image-2.6-flash,并已通过 microsoft foundry 平台面向公众开放预览。作为上月在多项技术评测中跻身榜首的 mai-image-2.6 的高效精简版,该变体的推出,彰显了微软加速推进ai图像生成技术在高并发、低延迟及成本敏感型工业级场景中规模化落地的战略意图。
实测结果表明,MAI-Image-2.6-Flash 的图像生成吞吐速度达 GPT-Image-2-Medium 的2.8倍,端到端综合效率提升幅度高达72%。在显著降低推理时延与算力消耗的前提下,该版本完整保留了原模型的核心能力,涵盖高质量文本到图像生成及细粒度局部对象级图像编辑功能。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

与此同时,MAI-Image-2.6 系列整体完成多维度架构升级:支持最多5张参考图输入,以强化跨图像的角色一致性与产品复现精度;深度集成 Bing 搜索能力,实现网络图像信息的实时检索与语义增强;并原生支持动态宽高比设定及更高分辨率图像输出。
在商业化部署层面,Flash 版本对各项输入输出单元定价作出大幅优化:文本输入、图像输入与图像输出的每百万 Token 费用分别降至1.75美元、2.50美元和19美元,相较标准版降幅超50%。
微软官方明确建议:主模型适用于对视觉保真度、文字渲染准确性要求严苛的商业设计与最终交付资产生产;而 Flash 版本则精准适配交互式前端应用、高频创意原型验证及海量图像自动化处理任务。这一兼顾顶尖性能与极致成本效益的双轨模型体系,印证了当前生成式AI正加速由实验室突破迈向大规模、可部署、可持续的工程化新阶段。

















