3.2標準
初期検索は候補を多く返すが、上位に回答根拠が来ない。
再ランキング導入の効果を検証する。
評価として適切なものを2つ選べ。
× 不正解
再ランキングは候補再現率、上位根拠の正確性・多様性・鮮度と、遅延・費用・権限を一緒に評価する。
詳細解説
正しい候補再現率を保ったまま、上位kの根拠正確性と多様性を比較する
再ランキング前後の上位品質を測れる。
再ランキング前後の上位品質を測れる。
問題の要件では、候補再現率を保ったまま、上位kの根拠正確性と多様性を比較するが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい遅延、トークン費用、権限フィルター、古い文書の順位も評価する
品質以外の運用・ガバナンス影響を確認できる。
品質以外の運用・ガバナンス影響を確認できる。
問題の要件では、遅延、トークン費用、権限フィルター、古い文書の順位も評価するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り上位1件の見た目だけで導入を決める
入力の多様性と候補の漏れを見落とす。
入力の多様性と候補の漏れを見落とす。
問題の要件では、上位1件の見た目だけで導入を決めるが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り再ランキングで権限チェックを置き換える
並び替えは認可を付与しない。
並び替えは認可を付与しない。
問題の要件では、再ランキングで権限チェックを置き換えるが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
Amazon Bedrock Knowledge Bases公式の再ランキング、検索評価、AIF-C01 Domain 3.2を確認する。期待される結果
再ランキングの品質向上と費用・権限の副作用を評価できる。理解のポイント
- 再現率
- 上位k
- 権限
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
再ランキング
初期検索候補を追加モデルや特徴で再び並べ替える処理。
上位k精度
ランキング上位k件の中に正しい根拠が含まれる程度。
問題IDAWS-AIF-282
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告