5.1標準
公開チャットボットへ機密情報の要求や有害な質問が来る。
入力と出力の両面で制御する。
対策として適切なものを2つ選べ。
× 不正解
ガードレールは入力と出力の両方へポリシーを適用し、検出時の拒否・置換・人手確認とログ保護を設計する。
詳細解説
正しい禁止カテゴリ、個人情報、プロンプトインジェクションの兆候を入力で検査する
危険な要求をモデル処理前に拒否・隔離できる。
危険な要求をモデル処理前に拒否・隔離できる。
問題の要件では、禁止カテゴリ、個人情報、プロンプトインジェクションの兆候を入力で検査するが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい生成出力の有害内容、秘密、ポリシー違反を検査する
入力検査を通過した場合でも、出力側の防御が必要である。
入力検査を通過した場合でも、出力側の防御が必要である。
問題の要件では、生成出力の有害内容、秘密、ポリシー違反を検査するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り入力検査があるので出力は無条件で表示する
モデルは別の形で安全でない内容を生成し得る。
モデルは別の形で安全でない内容を生成し得る。
問題の要件では、入力検査があるので出力は無条件で表示するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り拒否された入力を全て無期限保存する
ログは最小化、アクセス制御、保存期間を設ける必要がある。
ログは最小化、アクセス制御、保存期間を設ける必要がある。
問題の要件では、拒否された入力を全て無期限保存するが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
Amazon Bedrock Guardrails公式資料とAIF-C01 Domain 5.1の入出力保護を確認する。期待される結果
入力だけでなく出力も検査する多層防御を説明できる。理解のポイント
- 入力検査
- 出力検査
- 多層防御
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
ガードレール
有害・禁止・機密などの入力と出力をポリシーに基づいて検査・制御する機能。
多層防御
認証、入力検査、モデル制約、出力検査、認可、監査などを重ねる設計。
問題IDAWS-AIF-129
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告