微軟9月正式推出自主研發圖像生成模型的輕量化變體 MAI-Image-2.6-Flash,並已通過 Microsoft Foundry 開啓公開預覽。作爲上月登頂技術榜單前列的 MAI-Image-2.6的高效率版本,該模型的推出標誌着微軟在AI圖像生成領域全面展開對高併發、低延遲及成本敏感型工業級應用場景的佈局。
測試數據顯示,MAI-Image-2.6-Flash 的圖像生成速度達到 GPT-Image-2-Medium 的2.8倍,整體綜合效率提升達72%。在大幅削減推理延遲與計算開銷的同時,該變體完整繼承了主模型的核心生成與編輯能力,支持高精度的文本到圖像生成以及局部對象級圖像編輯。

此外,MAI-Image-2.6系列整體帶來了多項架構級升級,包括支持最多5張參考圖以保障多圖角色與產品的一致性、集成 Bing 搜索的網絡定位功能以補充現實世界圖像信息,並新增對動態寬高比和更高分辨率輸出的原生支持。
在商業化定價策略上,Flash 版本將文本輸入、圖像輸入和圖像輸出的每百萬 Token 價格分別下探至1.75美元、2.50美元和19美元,較主模型實現了超過50%的顯著降本。
微軟官方建議將主模型應用於對畫質和文本渲染要求苛刻的商業設計與最終生產資產,而將 Flash 版本精確定位於交互式應用、快速創意迭代以及大規模自動化流程。這一兼顧極端性能與極致性價比的多模態模型矩陣,反映出當前生成式AI從單一技術突破向高吞吐量、低成本工程化落地演進的行業趨勢。
VIP會員