2.3標準
子ども向けチャットで有害表現を抑える。
無害な教育質問を過剰に拒否しない。
運用として適切なものを2つ選べ。
× 不正解
フィルターはカテゴリ・閾値・拒否・代替を評価セットで調整し、誤検知・見逃し・言語差・回避入力と版を監視する。
詳細解説
正しい禁止カテゴリ、検出閾値、拒否文、無害な代替を評価セットで調整する
安全性と有用性のトレードオフを測れる。
安全性と有用性のトレードオフを測れる。
問題の要件では、禁止カテゴリ、検出閾値、拒否文、無害な代替を評価セットで調整するが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい誤検知・見逃し・言語差・回避入力を監視し、変更を版管理する
フィルター更新の影響を追跡できる。
フィルター更新の影響を追跡できる。
問題の要件では、誤検知・見逃し・言語差・回避入力を監視し、変更を版管理するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り閾値を最大にすれば安全性と有用性が自動的に最適になる
過剰拒否や見逃しが生じ得る。
過剰拒否や見逃しが生じ得る。
問題の要件では、閾値を最大にすれば安全性と有用性が自動的に最適になるが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤りフィルター設定を変更しても再評価しない
安全性の回帰を見逃す。
安全性の回帰を見逃す。
問題の要件では、フィルター設定を変更しても再評価しないが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS公式AIF-C01 Domain 2.3のGuardrails、コンテンツフィルター、安全性評価を確認する。期待される結果
安全性と有用性をフィルターの閾値・誤り・版管理で運用できる。理解のポイント
- 誤検知
- 見逃し
- 版管理
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
コンテンツフィルター
有害・禁止・機密などの内容を検出し、拒否・マスク・代替する制御。
誤検知・見逃し
無害な入力を危険と判定する誤りと、危険な内容を通してしまう誤り。
問題IDAWS-AIF-300
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告