1.3基礎
S3へ新しいデータが到着したら、クローラーでスキーマを更新し、その後Glue ETLを実行する。
ジョブ間の順序をGlue内で管理する。
最も適切な構成はどれか。
× 不正解
Glue Workflowとトリガーを使うと、クローラー成功後にETLジョブを起動する依存関係を定義できる。
詳細解説
正しいAWS Glue Workflowとトリガー
クローラー成功を条件にETLジョブを起動し、処理の依存関係をGlue内で定義できる。
クローラー成功を条件にETLジョブを起動し、処理の依存関係をGlue内で定義できる。
誤りS3のバージョニング
オブジェクト版管理であり、クローラー成功後のジョブ起動を行わない。
オブジェクト版管理であり、クローラー成功後のジョブ起動を行わない。
誤りCloudTrail Event History
API操作の記録で、Glueジョブの依存起動を定義しない。
API操作の記録で、Glueジョブの依存起動を定義しない。
誤りRedshift UNLOAD
データを書き出す操作で、Glueジョブの起動順序を管理しない。
データを書き出す操作で、Glueジョブの起動順序を管理しない。
実際に確かめる
一時的な検証環境で実行できる例です。
AWS Glue Workflow、Trigger、Crawler、Jobの公式説明を確認する。期待される結果
データ保存とGlueワークフローの実行制御を区別できる。理解のポイント
- Glue Workflow
- Crawler
- Trigger
- 依存関係
確認時の注意
- 確認環境: AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
- AWS公式DEA-C01 Domain 1・Task 1.3と各サービスの公式ドキュメントを確認する。
基礎のおさらい
メタデータ更新
クローラーによるカタログ更新をETL開始条件にするか、スキーマ契約で管理するかを決める。
失敗伝播
クローラー失敗時にETLを止め、通知・再試行・手動承認を定義する。
問題IDAWS-DEA-057
確認環境AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告