1.1基礎
通話音声を文字起こしし、話者や感情を分析する。
必要なAIタスクを分ける。
対応として適切なものを2つ選べ。
× 不正解
音声認識は音声を文字列へ変換し、話者識別・感情分類・本人確認は別のタスクとして要件と評価を分ける。
詳細解説
正しい音声をテキストへ変換するなら自動音声認識を使う
音声信号から文字列を得るタスクである。
音声信号から文字列を得るタスクである。
問題の要件では、音声をテキストへ変換するなら自動音声認識を使うが解決する範囲と、別の工程が担う範囲を分けて判断する。
正しい話者や感情を判定するなら話者識別や音声分類を別に検討する
文字起こしと属性判定は異なる出力である。
文字起こしと属性判定は異なる出力である。
問題の要件では、話者や感情を判定するなら話者識別や音声分類を別に検討するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り文字起こしだけで話者の本人確認を保証する
音声認識と話者認証は別タスクである。
音声認識と話者認証は別タスクである。
問題の要件では、文字起こしだけで話者の本人確認を保証するが解決する範囲と、別の工程が担う範囲を分けて判断する。
誤り音声品質や雑音は認識結果へ影響しない
入力条件と方言・言語を評価する必要がある。
入力条件と方言・言語を評価する必要がある。
問題の要件では、音声品質や雑音は認識結果へ影響しないが解決する範囲と、別の工程が担う範囲を分けて判断する。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS公式AIF-C01 Domain 1.1の音声認識、分類、AIタスクを確認する。期待される結果
音声を文字化する処理と、話者・感情・認証を区別できる。理解のポイント
- 音声認識
- 話者識別
- 音声品質
確認時の注意
- 確認環境: AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
- AWS公式ドキュメントで、対象サービスが提供する機能と前提条件を確認する。
- モデル、データ、アプリケーション、利用者の責任分界を混同しない。
基礎のおさらい
自動音声認識
音声信号を文字列へ変換する処理。
話者識別
音声の特徴から誰が話しているかを判定する処理。
問題IDAWS-AIF-292
確認環境AWS公式AIF-C01試験ガイドとAWS公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告