1.2基礎
日次で作成されたS3のParquetデータをRedshiftへロードする。
行単位のINSERTを繰り返さず、分析用テーブルへ効率的に取り込む。
最も適切なSQL操作はどれか。
× 不正解
Redshift COPYはS3上のParquetなどをRedshiftテーブルへ並列ロードする。IAMロール、形式、マニフェスト、重複処理を確認する。
詳細解説
正しいCOPY
S3のファイルをRedshiftテーブルへ並列ロードする操作である。
S3のファイルをRedshiftテーブルへ並列ロードする操作である。
誤りUNLOAD
Redshiftのデータを外部へ書き出す操作で、S3からの取り込みではない。
Redshiftのデータを外部へ書き出す操作で、S3からの取り込みではない。
誤りVACUUMだけ
削除済み領域の整理や並べ替えを行うが、S3ファイルをロードしない。
削除済み領域の整理や並べ替えを行うが、S3ファイルをロードしない。
誤りCloudFormation CREATE_STACK
インフラを作成する操作で、テーブルデータのロードは行わない。
インフラを作成する操作で、テーブルデータのロードは行わない。
実際に確かめる
一時的な検証環境で実行できる例です。
Amazon Redshift COPYのS3、Parquet、IAMロールの公式説明を確認する。期待される結果
COPYとUNLOADの方向・用途の違いを説明できる。理解のポイント
- Redshift COPY
- Parquet
- 一括ロード
- S3
確認時の注意
- 確認環境: AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
- AWS公式DEA-C01 Domain 1・Task 1.2と各サービスの公式ドキュメントを確認する。
基礎のおさらい
ロード方向
COPYは外部ストレージからRedshiftへ、UNLOADはRedshiftから外部ストレージへデータを移動する。
ロードの再実行
ファイル単位・マニフェスト・ステージングを使い、重複ロードと部分失敗を管理する。
問題IDAWS-DEA-032
確認環境AWS公式DEA-C01試験ガイドと各サービスの公式ドキュメントの確認
最終技術確認2026-08-20
誤り・権利侵害を報告