Azure AI Foundryのクラシックポータルでは、Microsoft Foundry Modelsの展開方法が複数用意されており、標準展開、サーバーレスAPI、マネージドコンピュートの3つから選択可能です。この記事では、更新された展開オプションの特徴、管理者や開発者が確認すべきポイント、移行や展開時の注意点を具体的に解説します。最適な選択肢を理解すれば、効率的かつ安全にモデルを運用できます。
目次
Microsoft Foundry Models (classic) の展開オプション
Foundry Modelsを活用するには、モデルを展開して推論リクエストを受け付けられる状態にする必要があります。展開方法は主に以下の3種類です。
標準展開(Foundryリソース利用)
- 特徴: 地域、データゾーン、グローバル処理をサポート。標準およびプロビジョンドスループット(PTU)オプションが利用可能。
- 利用対象: Foundryリソース、Azure OpenAIリソース、Azure AIハブ接続時。
- 推奨ポイント: 可能な限り標準展開を利用することで、最も多くの機能が利用可能。コンテンツフィルタリング、カスタム認証などもサポート。
サーバーレスAPIエンドポイント
- 特徴: AIハブリソース上で専用APIエンドポイントを作成。ペイアズユーゴー課金で利用可能。
- 制限: 地域展開のみ。カスタムコンテンツフィルタリング不可。キー不要認証不可。
- 推奨シーン: 短期間のテストや負荷が不定期な場合。サーバー管理不要で手軽にAPI化可能。
マネージドコンピュート展開
- 特徴: 専用コンピュートでモデルをホスト。計算リソース単位で課金。Hugging Face、NVIDIA推論マイクロサービス、カスタムモデルなどで必須。
- 制限: サブスクリプションにコンピュートクォータが必要。カスタム設定や特殊モデルに対応。
- 推奨シーン: 高性能モデルや業界固有モデル、継続的な稼働が必要なケース。
展開オプション比較
| 機能 | 標準展開 | サーバーレスAPI | マネージドコンピュート |
|---|---|---|---|
| 展開可能モデル | Azure販売Foundryモデル、パートナーモデル | ペイアズユーゴーモデル | カスタム、オープンモデル |
| 展開リソース | Foundryリソース | AIハブプロジェクト | AIハブプロジェクト |
| 地域/データゾーン | 地域、データゾーン、グローバル | 地域のみ | 地域のみ |
| プライベートネットワーク | 可 | 可 | 可 |
| コンテンツフィルタリング | 標準・カスタム | 標準のみ | 不可 |
| 認証 | キー可 | キー不可 | キー不可 |
| 課金形態 | トークン/PTU | トークン | コンピュート時間 |
管理者・開発者が確認すべきポイント
- 展開対象モデルの種類: カスタムやHugging Faceなどはマネージドコンピュート必須。
- 課金方式の理解: ペイアズユーゴーとPTU/コンピュート時間の違いを把握。
- ネットワーク・データゾーン要件: 機密データの場合、地域・データゾーン指定が可能な標準展開が優先。
- 移行時の注意: クラシックポータルでの設定は新ポータルに自動移行されない場合があるため、設定情報のバックアップを推奨。
まとめ:次に取るべき行動
- 展開予定モデルの種類と利用環境を確認。
- 標準展開が可能かを優先的に判断。
- サーバーレスAPIやマネージドコンピュートが必要な場合はリソースと課金方式を事前に確認。
- 移行・更新の際はクラシックポータルでの設定情報を記録しておく。
これらを踏まえれば、Azure AI Foundryでのモデル展開を安全かつ効率的に行えます。

コメント