MAI-Image-2.6は何が向上?Arena 2位・文字描画+91 Eloの見方と評価方法

MAI-Image-2.6は、前世代のMAI-Image-2.5から画質と文字描画性能を大きく伸ばしたMicrosoft AIの画像生成モデルです。Microsoftの発表では、ArenaのText-to-Image総合ランキングで2位となり、MAI-Image-2.5比で総合スコアが79 Elo、文字描画が91 Elo向上しました。特に、文字入り広告、商品ビジュアル、ポスター、3D表現などで有力な選択肢になっています。(Microsoft AI)

ただし、「文字描画+91 Elo」は文字の正確性が91%向上したという意味ではありません。また、Arenaで2位だからといって、日本語広告、画像編集、APIコスト、生成速度まで一律に優れているとも限りません。実際に導入する際は、Arenaの評価と自社の制作ベンチマークを分けて判断することが重要です。

目次

MAI-Image-2.6は2.5から何が向上した?

Microsoftが2026年8月10日に公開し、8月18日に更新した発表内容を整理すると、MAI-Image-2.6の主な改善点は次のとおりです。(Microsoft AI)

評価項目MAI-Image-2.6の結果実制作で期待できること
Text-to-Image総合Arena 2位、2.5比+79 Elo幅広いプロンプトで好まれる画像を生成しやすい
文字描画2.5比+91 Eloポスター、パッケージ、広告内の文字表現を改善
ポートレート品質向上を報告顔、肌、照明を含む人物ビジュアルへの適性向上
3Dイメージ品質向上を報告立体物、製品モックアップ、CG風素材への適性向上
商用ビジュアル品質向上を報告商品広告、ブランディング、キャンペーン素材に活用しやすい
フォトリアル・シネマティック品質向上を報告写真風素材、キービジュアル、映像的な構図を作りやすい

Microsoftは、Arenaで測定されたすべてのText-to-Imageカテゴリーにおいて、MAI-Image-2.5から改善したと説明しています。特に強調されているのは、文字描画、ポートレート、3D、商品・ブランド広告、フォトリアル、シネマティック表現です。(Microsoft AI)

2026年8月25日時点でも総合2位を維持

Arenaの2026年8月25日時点の集計では、MAI-Image-2.6 Previewは総合2位で、スコアは1331±8でした。MAI-Image-2.5は10位の1254±4です。文字描画カテゴリーでも、2.6は2位の1367±15、2.5は9位の1283±6となっています。(アリーナAI)

Arenaの指標MAI-Image-2.6 PreviewMAI-Image-2.5スコアの単純差
Text-to-Image総合2位・1331±810位・1254±477
Text Rendering2位・1367±159位・1283±684

発表時の「総合+79」「文字描画+91」と、8月25日時点の単純差が一致しないのは不自然ではありません。Arenaは投票が追加されるたびに集計が更新されるライブ型のランキングであり、スコアや順位は固定値ではないためです。

重要なのは、数ポイントの違いではなく、総合と文字描画の両方でMAI-Image-2.5を大きく上回っていることです。

Arena 2位と+79 Eloを正しく読む

Arenaでは、同じプロンプトに対して2つの匿名モデルが出力した結果を利用者が比較し、どちらを好むか投票します。投票後にモデル名が表示され、匿名状態で行われた投票だけが公式ランキングに反映されます。(Arena AI)

集まった比較結果は、ペア比較のための統計モデルであるBradley-Terry方式を用いてスコア化されます。Arenaは、この方式をチェスなどで使われるEloレーティングに似た仕組みとして説明しています。(Arena AI)

+91 Eloは91%向上という意味ではない

「文字描画+91 Elo」は、次の意味ではありません。

  • 文字認識率が91%向上した
  • 91%の画像で文字が完全一致する
  • 文字生成の失敗が91%減った
  • 日本語の漢字や縦書きにも91%成功する

Elo系のスコアは、他モデルとの比較でどちらが好まれたかを表す相対値です。文字を一字ずつ照合して採点した正解率ではありません。

文字が少し間違っていても、構図、色、質感、文字の見栄えを含めた画像全体が好まれれば、投票で勝つ可能性があります。反対に、文字が正しくても、全体のデザインが弱ければ選ばれないことがあります。

順位だけでなく投票数と誤差も確認する

2026年8月25日時点で、MAI-Image-2.6のText-to-Image総合投票数は6,418票、MAI-Image-2.5は56,737票でした。文字描画カテゴリーでも、2.6は1,932票、2.5は19,396票です。新しい2.6は投票数がまだ少ないため、スコアの誤差幅も2.5より大きくなっています。(アリーナAI)

Arenaも、新しく追加されたモデルや投票数が少ないモデルは、推定スコアの信頼区間が広くなると説明しています。(Arena AI)

そのため、2位という順位は有力な評価材料ですが、「どの条件でも確実に2番目に優れている」と断定するのは適切ではありません。

Arenaから判断しやすいことArenaだけでは判断できないこと
幅広い利用者がどちらの出力を好んだか日本語が一字も間違わず描画されるか
競合モデルに対する総合的な立ち位置自社商品や業界特有の画像を正しく作れるか
ポートレートや文字描画などの相対的な強さAPIの速度、料金、同時実行性能
世代間で品質が改善した傾向同じ品質を大量生成で維持できるか
出力全体の視覚的な好ましさロゴ、価格、注意書きの正確性

文字描画+91 Eloが実制作で重要な理由

画像生成AIの文字描画が改善すると、単に画像内へ文字を置けるだけでなく、文字を構図の一部として設計しやすくなります。

例えば、次のような制作で効果が期待できます。

  • 商品名が入ったパッケージのラフ
  • キャッチコピーを含むWeb広告
  • イベントポスターやSNS告知画像
  • 店舗看板やサイネージのイメージ
  • タイトル入りの動画サムネイル
  • 文字を立体化した3Dビジュアル
  • 雑誌表紙やキャンペーンのキービジュアル

従来の「背景だけAIで作り、文字は後から配置する」という制作方法に加え、文字を含めた全体の構図をAIに提案させやすくなります。

ただし、実制作では「文字が美しく見えること」と「指定した文字列が完全に正しいこと」を分けて評価しなければなりません。

日本語は独自のテストが必要

Arenaの公開ランキングでは、商品・ブランディング、3D、アニメ、フォトリアル、アート、ポートレート、文字描画といった用途別カテゴリーが用意されています。一方、日本語文字だけを対象とした専用スコアは公開画面上に示されていません。(アリーナAI)

そのため、日本語圏で利用する場合は、少なくとも次の要素を含む独自テストが必要です。

  • 漢字、ひらがな、カタカナの混在
  • 長音記号「ー」と漢数字「一」
  • 小書き文字の「ャ」「ュ」「ョ」「ッ」
  • 全角と半角の数字
  • カンマ、ピリオド、中黒、括弧
  • 金額、日付、電話番号
  • 英字と日本語の混在
  • 縦書き
  • 複数行の文字
  • 小さい注記

特に、価格、日付、連絡先、商品規格などは、一文字の誤りがそのまま事故につながります。最終成果物に使う場合は、画像生成後に必ず目視確認し、必要に応じてデザインソフトで正しい文字を重ねてください。

MAI-Image-2.6の文字描画ベンチマークを作る方法

実務で使えるかを判断するには、普段制作している画像に近いプロンプトを用意します。英単語を一つ表示させるだけでは、日本語広告への適性を十分に評価できません。

用意すべきテストパターン

テスト指定文字の例確認するポイント
短い見出し未来を、描く。一字単位の正確性、句読点
商品パッケージ八ヶ岳ブレンド/深煎り 200g複数行、文字の階層、数字
イベント告知AI CREATIVE DAY/2026.09.03/SUWA HALL英数字、日付、行の順番
価格入り広告数量限定30個/税込1,980円数字、カンマ、円表記
日本語混在信州産りんご100%使用漢字、かな、記号
小さい注記写真はイメージです小サイズでの可読性
縦書き秋の特別企画文字方向と配置
曲面上の文字ボトルのラベル遠近感、文字の変形

テスト用プロンプト例

白いクラフト紙で作られたコーヒー袋の商品広告。
袋の中央に「八ヶ岳ブレンド」、その下に「深煎り 200g」、
右下に「数量限定」と正確に表示する。
指定した文字以外は入れない。
自然光の商品写真、落ち着いた高級感、縦長4:5。

短いプロンプトだけでなく、複数の文字列、配置、サイズ、背景を指定した条件でも試します。

「指定した文字以外は入れない」と書いても、不要な文字や読めない記号が生成されることがあります。プロンプトの指示だけを信用せず、出力結果で判定してください。

公平に比較する手順

MAI-Image-2.5と2.6を比較する場合は、次の条件をそろえます。

  1. 20種類程度の共通プロンプトを用意する
  2. アスペクト比、解像度、品質設定、出力枚数をそろえる
  3. シードを指定できる環境では同じシードを使う
  4. 各プロンプトから4枚程度ずつ生成する
  5. モデル名を隠して評価する
  6. 実際に掲載するサイズまで縮小して確認する
  7. 生成時間と手作業による修正時間も記録する

20プロンプトを各4枚生成すれば、1モデルにつき80枚です。厳密な学術評価ではありませんが、小規模な社内比較としては、偶然良い1枚が出ただけなのか、安定して改善しているのかを見分けやすくなります。

文字描画の採点例

評価項目配点例判定方法
指定文字の完全一致40点誤字、脱字、文字化けがない
不要な文字がない15点指定外の単語や記号がない
行順と配置15点指定した順序、位置、改行になっている
実寸での可読性10点広告やサムネイルの掲載サイズで読める
デザインとの統合10点文字が背景から浮かず、構図に合っている
再現性10点複数回生成しても一定の成功率を保つ

完全一致率は、次の式で記録できます。

完全一致率 = 指定文字がすべて正しかった画像数 ÷ 総生成枚数 × 100

広告の価格や開催日など、正確性が必須の文字については、総合点が高くても一文字間違っていれば不合格にします。

画質向上は「きれいか」だけで判断しない

Microsoftは、MAI-Image-2.6でポートレート、3D、商品・ブランド広告、フォトリアル、シネマティック表現が向上したと説明しています。(Microsoft AI)

実制作では、単に印象が良いかだけでなく、次の項目を分けて評価します。

評価項目確認内容よくある失敗
プロンプト遵守人数、物の数、色、位置が指定どおりか商品が増える、色が変わる
構図余白、視線誘導、見切れ文字を置く場所がない
ポートレート顔、目、髪、手、肌の質感指や歯、アクセサリーが崩れる
商品表現形状、材質、反射、ラベル容器の左右が非対称になる
3D表現奥行き、接地、影、形状物体が浮く、影の方向が合わない
フォトリアル光源、レンズ感、質感過度に滑らかで人工的になる
文字描画正確性、可読性、配置似た文字への置換、余計な文字
トリミング耐性PC、スマホ、SNSで切れないか重要部分が画面外になる
再現性複数回生成して品質が安定するか当たり画像が一度しか出ない
修正工数採用まで何分かかるか再生成と手直しを繰り返す

特に重要なのが、採用率と修正時間です。

見栄えが非常に良くても、10回生成して1枚しか使えないモデルは、大量制作には向きません。反対に、最高品質ではなくても、4枚中3枚がそのままラフに使えるモデルは、日常業務では高い生産性を発揮します。

次の数値を記録しておくと、モデルを比較しやすくなります。

  • 生成画像の採用率
  • 文字の完全一致率
  • 1件あたりの再生成回数
  • 1件あたりの手作業修正時間
  • 平均生成時間
  • 最終成果物1件あたりの費用

Text-to-Imageと画像編集を混同しない

文字描画の「+91 Elo」は、テキストから新しい画像を作るText-to-Image評価での改善です。既存画像内の文字を書き換えるImage Edit評価とは別の結果です。

Microsoftが8月18日に追加した情報では、MAI-Image-2.6は画像編集ランキングで3位となり、MAI-Image-2.5比で総合19ポイント向上しました。画像編集における改善は、文字描画が43ポイント、商品・ブランディング・商用デザインが38ポイントとされています。(Microsoft AI)

Arenaの2026年8月25日時点の画像編集ランキングでも、2.6は3位の1417±7、2.5は5位の1399±4でした。(アリーナAI)

作業確認すべきベンチマーク
プロンプトから広告画像を新規作成Text-to-Image
プロンプトから文字入りポスターを作成Text-to-ImageのText Rendering
既存写真のラベルを書き換えるImage EditのText Rendering
商品だけ差し替えるImage EditのCommercial Design
人物の服や背景を変更するImage EditのPortraitsまたはPhotorealistic
複数の参照画像を組み合わせるMulti Image Editや個別の参照画像テスト

既存の商品写真にある文字を変更したい場合、Text-to-Imageの+91だけを見て採用してはいけません。元画像をどれだけ保持できるか、指定した部分だけを変更できるかを含め、画像編集として評価する必要があります。

MAI-Image-2.6が向いている制作

MAI-Image-2.6は、次のような場面で優先的に試す価値があります。

商品・ブランドビジュアルの企画

商品パッケージや広告の初期案を、文字を含めて複数パターン生成できます。商品名の配置やキャッチコピーの見せ方まで含めたデザインラフを作る用途と相性がよいでしょう。

ポスターやSNS広告のラフ

背景、人物、タイトルを一体として生成し、完成イメージを早い段階で共有できます。最終文字だけデザインソフトで差し替える運用にすると、正確性と生成AIの表現力を両立できます。

3D風のタイトルや立体表現

文字を金属、ガラス、布、木材などの質感で表現したい場合、文字描画と3D表現の改善を同時に生かせます。

写真風のキービジュアル

人物、商品、自然光、映画的な照明を組み合わせたキャンペーン画像の候補作成に適しています。ただし、人物や商品の事実性が必要な案件では、実写素材との混同を避ける運用が必要です。

そのまま納品する用途では慎重な確認が必要

次の用途では、画像生成結果に文字を焼き込んだまま納品するより、背景と構図だけを生成し、文字やロゴを後から配置する方が安全です。

  • 商品価格を掲載する広告
  • 開催日時や会場を告知するポスター
  • 契約条件や注意事項を含む画像
  • 電話番号やURLを掲載する画像
  • 企業ロゴや正式なブランド表記
  • 特定フォントの厳密な使用が必要な制作
  • 法定表示を含むパッケージ
  • 印刷前提の小さな本文

生成画像で文字が読めていても、指定フォントそのものが使われているとは限りません。ロゴ、正式名称、法定表示、価格などは、正規データを使ってPowerPoint、Figma、Illustrator、Photoshopなどで重ねる方が確実です。

MAI-Image-2.6を試す方法と導入時の注意点

Microsoftの2026年8月18日更新では、MAI-Image-2.6はMAI Playgroundで利用可能となり、Microsoft FoundryではPrivate Previewとして提供されていると説明されています。MAI PlaygroundにもMAI-Image-2.6が掲載されていますが、サービス自体は新しい実験的モデルを試す限定プレビューとして案内されています。(Microsoft AI)

まず品質を確認するだけなら、MAI Playgroundで自社向けプロンプトを試します。APIや業務システムへ組み込む場合は、Microsoft Foundry側で次の項目を確認してください。

  • 自分の契約とリージョンで利用できるか
  • Previewか一般提供か
  • 生成可能な解像度とアスペクト比
  • 画像入力や編集に対応しているか
  • 料金とレート制限
  • 同時実行数
  • データの保存・処理条件
  • 商用利用時の規約
  • モデルバージョンの固定可否
  • API更新による出力変化への対策

MAI-Image-2.5の料金や仕様が、そのまま2.6にも適用されるとは限りません。モデルカタログや利用画面に表示される最新条件を確認してから、本番利用を決定してください。

MAI-Image-2.6はArena評価と自社テストを組み合わせて判断する

MAI-Image-2.6は、ArenaのText-to-Image総合2位、MAI-Image-2.5比で総合+79 Elo、文字描画+91 Eloという強い改善結果を示しました。ポートレート、3D、商品広告、ブランディング、フォトリアル表現にも改善が広がっており、Microsoft AIの画像生成モデルとして優先的に検証する価値があります。

一方、Arenaは人間の総合的な好みを集計したランキングです。日本語の完全一致率、生成速度、料金、再現性、画像編集の保持性能までは保証しません。

導入前に取るべき行動は明確です。

  1. 普段の制作に近い日本語プロンプトを20種類程度用意する
  2. MAI-Image-2.5と2.6を同条件で複数回生成する
  3. 文字の完全一致率、採用率、修正時間を記録する
  4. 新規生成と画像編集を別々に評価する
  5. 正確な文字が必須の成果物は、最終工程で文字を重ねる

Arenaの順位は候補モデルを絞り込むために使い、最終判断は実際の制作データで行うことが、MAI-Image-2.6を安全かつ効果的に活用する方法です。

この記事を書いた人

実務の現場で詰まりがちなポイントを地図にするITブログ「IT trip」を運営。Windows/Office(Teams・Excel)からSQL、サーバ運用、ガジェットまで、再現性のある手順と“なぜそうなるか”を丁寧に解説します。読んだらすぐ試せること、そして迷った人の次の一歩が見えることを大切にしています。

コメント

コメントする

目次