このラボでは、社外公開するチャットボットの想定で、Azure OpenAI に組み込まれたコンテンツ フィルターを自社の基準に合わせてカスタマイズします。「モデルが何を言うか」ではなく「何を言わせないか」を設計する、責任ある AI の実装です。
学習目標:
- Azure OpenAI リソースと小型モデルのデプロイ
chat を用意する
- 既定のコンテンツ フィルター(4 カテゴリ × 入力/出力)の動作を確認する
- Azure AI Foundry でカスタム コンテンツ フィルターを作成し、重大度のしきい値を変更する
- ブロックリスト(禁止語)を作成し、フィルターに紐づける
- プロンプト シールド(ジェイルブレイク攻撃の検出)を有効にし、デプロイに適用して挙動を確認する
- Python から呼び出したときのフィルター エラー(HTTP 400
content_filter)を扱う
前提知識:
- 「Azure OpenAI をデプロイしてチャット プレイグラウンドで挙動を確かめる」ラボ相当の経験
完了条件:
- Azure OpenAI リソースにユーザー定義のコンテンツ フィルター(RAI ポリシー)が存在すること
- デプロイ
chat が存在し、カスタム フィルターが適用されていること
- ブロックリストの語を含む入力が拒否されることを確認できていること