Azure AI Foundry クラシックモデルの展開オプションと注意点

Azure AI Foundryのクラシックポータルでは、Microsoft Foundry Modelsの展開方法が複数用意されており、標準展開、サーバーレスAPI、マネージドコンピュートの3つから選択可能です。この記事では、更新された展開オプションの特徴、管理者や開発者が確認すべきポイント、移行や展開時の注意点を具体的に解説します。最適な選択肢を理解すれば、効率的かつ安全にモデルを運用できます。

目次

Microsoft Foundry Models (classic) の展開オプション

Foundry Modelsを活用するには、モデルを展開して推論リクエストを受け付けられる状態にする必要があります。展開方法は主に以下の3種類です。

標準展開(Foundryリソース利用)

  • 特徴: 地域、データゾーン、グローバル処理をサポート。標準およびプロビジョンドスループット(PTU)オプションが利用可能。
  • 利用対象: Foundryリソース、Azure OpenAIリソース、Azure AIハブ接続時。
  • 推奨ポイント: 可能な限り標準展開を利用することで、最も多くの機能が利用可能。コンテンツフィルタリング、カスタム認証などもサポート。

サーバーレスAPIエンドポイント

  • 特徴: AIハブリソース上で専用APIエンドポイントを作成。ペイアズユーゴー課金で利用可能。
  • 制限: 地域展開のみ。カスタムコンテンツフィルタリング不可。キー不要認証不可。
  • 推奨シーン: 短期間のテストや負荷が不定期な場合。サーバー管理不要で手軽にAPI化可能。

マネージドコンピュート展開

  • 特徴: 専用コンピュートでモデルをホスト。計算リソース単位で課金。Hugging Face、NVIDIA推論マイクロサービス、カスタムモデルなどで必須。
  • 制限: サブスクリプションにコンピュートクォータが必要。カスタム設定や特殊モデルに対応。
  • 推奨シーン: 高性能モデルや業界固有モデル、継続的な稼働が必要なケース。

展開オプション比較

機能標準展開サーバーレスAPIマネージドコンピュート
展開可能モデルAzure販売Foundryモデル、パートナーモデルペイアズユーゴーモデルカスタム、オープンモデル
展開リソースFoundryリソースAIハブプロジェクトAIハブプロジェクト
地域/データゾーン地域、データゾーン、グローバル地域のみ地域のみ
プライベートネットワーク可可可
コンテンツフィルタリング標準・カスタム標準のみ不可
認証キー可キー不可キー不可
課金形態トークン/PTUトークンコンピュート時間

管理者・開発者が確認すべきポイント

  • 展開対象モデルの種類: カスタムやHugging Faceなどはマネージドコンピュート必須。
  • 課金方式の理解: ペイアズユーゴーとPTU/コンピュート時間の違いを把握。
  • ネットワーク・データゾーン要件: 機密データの場合、地域・データゾーン指定が可能な標準展開が優先。
  • 移行時の注意: クラシックポータルでの設定は新ポータルに自動移行されない場合があるため、設定情報のバックアップを推奨。

まとめ:次に取るべき行動

  1. 展開予定モデルの種類と利用環境を確認。
  2. 標準展開が可能かを優先的に判断。
  3. サーバーレスAPIやマネージドコンピュートが必要な場合はリソースと課金方式を事前に確認。
  4. 移行・更新の際はクラシックポータルでの設定情報を記録しておく。

これらを踏まえれば、Azure AI Foundryでのモデル展開を安全かつ効率的に行えます。

この記事を書いた人

実務の現場で詰まりがちなポイントを地図にするITブログ「IT trip」を運営。Windows/Office(Teams・Excel)からSQL、サーバ運用、ガジェットまで、再現性のある手順と“なぜそうなるか”を丁寧に解説します。読んだらすぐ試せること、そして迷った人の次の一歩が見えることを大切にしています。

コメント

コメントする

目次