4.3標準
モデルが危険な表現を含む回答を生成する。
誤検知と見逃しを両方管理する。
対策として適切なものを2つ選べ。
× 不正解
有害出力はカテゴリ・重大度・言語・文脈で検出し、表示・拒否・人手確認を分ける。誤検知・見逃し・説明・異議申立て・ログ最小化も設計する。
詳細解説
正しいカテゴリ・重大度・言語・文脈に基づく検出を使い、しきい値ごとに表示・拒否・人手確認を分ける
影響に応じて処理できる。
影響に応じて処理できる。
問題の要件では、カテゴリ・重大度・言語・文脈に基づく検出を使い、しきい値ごとに表示・拒否・人手確認を分けるが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい代表例と攻撃例で誤検知・見逃し・言語差を測り、利用者への説明と異議申立てを設ける
検出の副作用を管理できる。
検出の副作用を管理できる。
問題の要件では、代表例と攻撃例で誤検知・見逃し・言語差を測り、利用者への説明と異議申立てを設けるが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り検出スコアを全言語・文脈で同じ意味とみなす
校正や言語差がある。
校正や言語差がある。
問題の要件では、検出スコアを全言語・文脈で同じ意味とみなすが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り検出された出力をログへ無制限に保存する
有害・個人情報の露出を増やす。
有害・個人情報の露出を増やす。
問題の要件では、検出された出力をログへ無制限に保存するが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS公式AIF-C01 Domain 4.3・5.2の有害出力、ガードレール、ログ保護を確認する。期待される結果
危険度に応じて出力を扱い、検出器の言語差と誤検知を改善できる。理解のポイント
- 有害出力
- 重大度
- 異議申立て
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
有害出力検出
危険・差別・違法などの表現を識別する処理。
重大度
影響や危険性の大きさで処理優先度を分ける尺度。
問題IDAWS-AIF-496
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告