マイクロソフトは9月に自社開発の画像生成モデルの軽量バージョン「MAI-Image-2.6-Flash」を正式リリースし、Microsoft Foundryを通じて公開プレビューを開始しました。先月技術ランキングで上位を記録したMAI-Image-2.6の効率的なバージョンとして、このモデルの登場はマイクロソフトがAI画像生成分野において、高同時接続数、低遅延、コストに敏感な産業向けの応用シーンへの全面的な展開を示しています。

テストデータによると、MAI-Image-2.6-Flashの画像生成速度はGPT-Image-2-Mediumの2.8倍に達し、全体的な効率は72%向上しています。推論遅延と計算コストを大幅に削減しながらも、このバージョンは本モデルの核心的な生成・編集機能を完全に引き継ぎ、高精度なテキストから画像への生成およびオブジェクトレベルでの画像編集をサポートしています。

QQ20260907-091347.jpg

また、MAI-Image-2.6シリーズ全体には複数のアーキテクチャレベルのアップグレードが含まれており、最大5枚の参照画像をサポートして、複数画像におけるキャラクターや製品の一貫性を確保したり、Bing検索を統合したネットワーク定位機能により現実世界の画像情報を補完したり、動的アスペクト比や高解像度出力のネイティブサポートを追加しています。

商業価格戦略において、Flashバージョンではテキスト入力、画像入力、画像出力の100万トークンあたりの価格がそれぞれ1.75ドル、2.50ドル、19ドルまで下がり、メインモデルに比べて50%以上のコスト削減が実現されています。

マイクロソフト公式は、メインモデルを画質やテキストレンダリングに厳しい要求がある商業デザインや最終的な生産資産に適していると推奨し、Flashバージョンはインタラクティブなアプリケーション、迅速なクリエイティブな反復、大規模な自動化プロセスに正確に位置づけられています。このような極端な性能と究極のコストパフォーマンスを兼ね備えたマルチモーダルモデルのマトリクスは、現在の生成型AIが単一の技術的突破から高スループット、低コストのエンジニアリングへの実装へと進化している業界トレンドを反映しています。