3.5基礎
S3データレイクへ日々ファイルが追加される。
Athenaで分析するため、スキーマとパーティションをカタログ化する。
最も適切な機能はどれか。
× 不正解
Glue CrawlerでS3データを検査し、Data Catalogへスキーマとパーティションを登録する。
詳細解説
正しいAWS Glue CrawlerでデータをスキャンしData Catalogへ登録する
Crawlerはデータを検査し、テーブル・スキーマ・パーティションをカタログへ登録する。
Crawlerはデータを検査し、テーブル・スキーマ・パーティションをカタログへ登録する。
誤りS3バケット名だけからすべての列型を推測する
バケット名はオブジェクト内容やスキーマを表さない。
バケット名はオブジェクト内容やスキーマを表さない。
誤りRoute 53のDNSクエリでParquetの列を検出する
DNSクエリはデータレイクのスキーマ検出ではない。
DNSクエリはデータレイクのスキーマ検出ではない。
誤りIAMロール名へテーブル定義を保存する
IAMロール名はデータカタログではない。
IAMロール名はデータカタログではない。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS Glue CrawlerとData Catalogの公式説明を確認する。期待される結果
データ検出・カタログ化とETL変換を区別できる。理解のポイント
- AWS Glue Crawler
- Data Catalog
- スキーマ
確認時の注意
- 確認環境: AWS公式Glueドキュメントの確認
- AWS公式SAA-C03 Domain 3と各サービスの公式ドキュメントを確認する。
基礎のおさらい
性能の見方
平均値だけでなく、ピーク時のレイテンシー、帯域、IOPS、同時実行数を確認する。
構成の確認
サービスの既定値と上限、データの配置、キャッシュやバッチ化の効果を比較する。
問題IDAWS-SAA-110
確認環境AWS公式Glueドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告