速度と品質を両立できるかが、生成型画像モデルの競争における新たな戦場となっている。文章作成者、出典:AIBase
公開背景
マイクロソフトは9月、自社開発の画像生成モデルの軽量バージョンであるMAI-Image-2.6-Flashを正式にリリースし、Microsoft Foundryを通じて公開ベータを開始しました。先月技術ランキングで上位にランクインしたMAI-Image-2.6の高効率版であるこのモデルのリリースは、マイクロソフトがAI画像生成分野で、高並列処理、低遅延、コスト感度の高い産業用途への本格的な展開を開始したことを示しています。
パフォーマンス
テストデータによると、MAI-Image-2.6-Flashの画像生成速度はGPT-Image-2-Mediumの2.8倍であり、全体的な総合効率は72%向上しました。推論遅延と計算オーバーヘッドを大幅に削減しながら、このバリアントはメインモデルの核心的な生成および編集機能を完全に継承し、高精度なテキストから画像への生成および局所的なオブジェクトレベルの画像編集をサポートします。
アーキテクチャのアップグレード
また、MAI-Image-2.6シリーズは、複数の参照画像によるキャラクターや製品の一貫性を確保するため最大5枚の参照画像をサポートし、Bing検索を統合したネットワーク検索機能を追加して現実の画像情報を補完し、動的アスペクト比と更高解像度出力のネイティブサポートを新たに追加しました。
商業化価格戦略において、Flashバージョンはテキスト入力、画像入力、画像出力の100万トークンあたりの価格をそれぞれ1.75ドル、2.50ドル、19ドルに引き下げ、メインモデルと比較して50%以上显著なコスト削減を実現しました。
マイクロソフトは、主モデルを画質とテキストレンダリングに高い要求がある商業デザインおよび最終生産アセットに適用することを推奨し、Flash版をインタラクティブアプリケーション、迅速なクリエイティブイテレーション、大規模な自動化プロセスに特化させています。この極限のパフォーマンスと極限のコストパフォーマンスを両立するマルチモーダルモデルマトリックスは、生成AIが単一の技術的ブレークスルーから高スループット・低コストのエンジニアリング実装へと進化する業界のトレンドを反映しています。
