2.2基礎
S3へ追加されるCSVとJSONのデータセットを分析対象にする。
ファイルをスキャンしてテーブル・列・形式をGlue Data Catalogへ登録する。
最も適切な方法はどれか。
× 不正解
Glue CrawlerはS3などのデータを分類し、Glue Data Catalogのテーブル・スキーマ・パーティションを作成または更新する。
詳細解説
正しいAWS Glue Crawlerを実行する
S3のデータを分類・推論し、Glue Data Catalogへテーブルとスキーマを登録・更新できる。
S3のデータを分類・推論し、Glue Data Catalogへテーブルとスキーマを登録・更新できる。
誤りS3ライフサイクルを設定する
オブジェクト保存期間を管理するだけで、列スキーマをCatalogへ登録しない。
オブジェクト保存期間を管理するだけで、列スキーマをCatalogへ登録しない。
誤りCloudTrailで列名を記録する
AWS API監査イベントはS3データの列スキーマ検出を行わない。
AWS API監査イベントはS3データの列スキーマ検出を行わない。
誤りIAM Access Analyzerでテーブルを作る
権限分析サービスであり、データスキーマの発見・登録はしない。
権限分析サービスであり、データスキーマの発見・登録はしない。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS Glue Crawler、Classifier、Data Catalogの公式説明を確認する。期待される結果
保存管理・監査・権限分析とメタデータ検出を区別できる。理解のポイント
- Glue Crawler
- Data Catalog
- Classifier
- スキーマ
確認時の注意
- 確認環境: AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
- AWS公式DEA-C01 Domain 2・Task 2.2と各サービスの公式ドキュメントを確認する。
基礎のおさらい
メタデータ分離
カタログはデータ本体ではなく、場所・形式・スキーマ・パーティションを管理する。
自動検出の限界
推論誤り、スキーマ変更、実行頻度、除外パスを検証する。
問題IDAWS-DEA-123
確認環境AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告