データパイプラインの構築・運用とデータストアの設計・管理。
対応ラボ 3 件 ·AWS 認定の試験ガイド ↗
S3 上の CSV データを Glue Crawler でデータカタログに登録し、Athena で SQL クエリを実行します。さらに CTAS で Parquet 形式に変換して、スキャン量を抑えた高速・低コストな分析基盤を体験します。
AWS Glue Studio のビジュアル ETL ジョブを使い、Amazon S3 に置いた CSV データを Amazon Redshift(プロビジョンド・ra3.large 2ノード)のテーブルへロードする一連の流れを、東京リージョンのコンソール操作だけで体験します。Glue が Redshift へ書き込む際に必要となる S3 ステージング領域と IAM ロールの構成まで含め、サーバーレス ETL の基本パターンを手を動かして学びます。
オンデマンドの Kinesis Data Stream を作成し、CloudShell から put-record でデータを投入、get-records で読み出しを確認します。