AWS認定資格 WEB問題集&徹底解説
データエンジニア-アソシエイト
分野1:データの取り込みと変換
- No.3 AWS GlueによるSpark ETLのコスト効率的なスケーリング
- No.8 実行時刻の制約がない AWS Glue ジョブのコスト最適化
- No.26 サーバーレスなログ集約基盤の構築
- No.59 S3から取り込むデータの増分処理を実現するAWS Glueの構成
- No.60 リアルタイムストリーム処理基盤の選定
- No.70 到着後ミリ秒単位でのストリーミング異常検知基盤
- No.77 コーディングなしでのデータクレンジングツールの選定
- No.92 Athena クエリ性能とコストの改善
- No.114 データレイクにおける重複レコードの除去方式
- No.127 AWS Glueによる重複商品データの名寄せ
- No.130 オンラインゲームでのDynamoDB変更のリアルタイム異常検知
- No.145 限られた列だけを使った異常検知基盤の構築
- No.153 生データゾーンと加工済みゾーンのストレージコスト最適化
- No.155 EKSにおける動的なワークロード向けノードプロビジョニング
- No.163 Athena Federated Query によるマルチソース結合のコスト最適化
- No.165 複数データソースへの横断的な SQL クエリ基盤
- No.177 サーバーレスETLパイプラインのIaCデプロイと自動スケーリング
- No.192 ストリーミングデータのフィルタリングとS3格納の最小運用構成
- No.203 REST API で受け付けたイベントのリアルタイム集計基盤
- No.207 ゲームテレメトリのリアルタイム処理基盤
- No.212 スキーマ変化を自動検知する ETL パイプライン
- No.218 リアルタイムイベント処理とTimestreamへの取り込み
- No.225 ストリーミングデータに対するSQLベースのリアルタイム異常検知
- No.236 増分データのみを取り込むステートフルな ETL
- No.238 配車マッチング基盤のリアルタイムストリーム処理化
- No.244 S3間ETLのためのマネージドSpark基盤選定
- No.246 S3からRedshiftへの増分データ取り込み
- No.248 S3データの変換とAuroraへの負荷を抑えたロード
- No.254 Excelファイルの複数列をJSON形式の1列にまとめる最小工数の方法
- No.277 DataBrew での結合フィールドの分割
- No.279 AWS Glue によるログの列指向変換パイプライン
- No.288 Athenaのクエリ結果を新規テーブル無しでORC出力する方法
- No.305 リアルタイム市場データの時間ベース集計基盤の選定
- No.326 AWS Glue ジョブのオートスケーリングによるコスト最適化
- No.341 日次データ抽出パイプラインの設計
- No.358 リアルタイムクリックストリーム分析の取り込みアーキテクチャ
- No.370 Athena のスキャン量とクエリコストを削減するデータ形式の最適化
- No.372 リアルタイムストリームでの異常検知に適したAWSサービス
- No.373 パーティション構成を変えずに Athena のクエリ性能を改善する
- No.375 コンテナ型 ETL 基盤の運用負荷を抑えるオーケストレーター選定
- No.387 複雑なネスト構造を持つデータレイクの列指向フォーマット選定
- No.395 Glue ジョブブックマークによる増分ETL処理
- No.411 順序保証が必要なオークション入札更新のストリーム処理構成
- No.413 CSV から列指向形式への自動変換パイプライン
- No.434 AWS Glue ETL ジョブのコスト最適化
- No.451 サーバーレスなETLジョブ管理サービスの選定
- No.468 共有EKSクラスター上のSparkジョブの実行時間短縮
- No.477 SQLに不慣れな分析者への自然言語クエリ支援
- No.494 巨大テーブルと小テーブルの結合でシャッフルを避ける
- No.495 再送で重複した注文データから最新行だけを抽出する
広告