3.1標準
顧客向けチャットで、短い回答を毎秒大量に返す必要がある。
複雑な長文推論より、応答時間とコストを重視する。
モデル選択で優先して比較する項目を2つ選べ。
× 不正解
モデルは品質だけでなく、代表的な入力でのレイテンシ、スループット、トークン単価、コンテキスト長など要件に合わせて比較する。
詳細解説
正しい想定入力・出力に対するレイテンシとスループット
対話の応答時間と同時実行数を満たすか、実際の代表プロンプトで測定する。
対話の応答時間と同時実行数を満たすか、実際の代表プロンプトで測定する。
問題の要件では、想定入力・出力に対するレイテンシとスループットが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい1リクエストあたりの推論コスト
大量利用では単価とトークン量が運用コストへ直結する。
大量利用では単価とトークン量が運用コストへ直結する。
問題の要件では、1リクエストあたりの推論コストが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤りモデル名の文字列の長さ
名称の長さは性能、料金、レイテンシの判断材料にならない。
名称の長さは性能、料金、レイテンシの判断材料にならない。
問題の要件では、モデル名の文字列の長さが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り訓練データのファイル名だけ
ファイル名だけではモデルの能力やサービス条件を判断できない。
ファイル名だけではモデルの能力やサービス条件を判断できない。
問題の要件では、訓練データのファイル名だけが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
Amazon Bedrock公式のモデル・推論料金・サービスクォータ情報を確認し、代表プロンプトで測定する。期待される結果
レイテンシ・スループット・コストをモデル選択の要件として比較できる。理解のポイント
- レイテンシ
- スループット
- 推論コスト
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
レイテンシ
リクエストを受けてから応答を返すまでの時間。
スループット
一定時間に処理できるリクエストやトークンの量。
問題IDAWS-AIF-035
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告