AWS認定資格 WEB問題集&徹底解説
データエンジニア-アソシエイト
- No.3 AWS GlueによるSpark ETLのコスト効率的なスケーリング
- No.5 Athenaクエリのパーティショニングとファイル形式最適化
- No.8 実行時刻の制約がない AWS Glue ジョブのコスト最適化
- No.9 Glueクローラーの実行時間短縮
- No.17 Glue ETL ジョブでのデータ品質検証の実装
- No.18 SQL Server から S3 への ETL パイプラインのオーケストレーション
- No.22 S3データをRedshiftへロードせずに結合クエリする方法
- No.34 Glue クローラーのスキーマ推定としきい値によるテーブル分割
- No.43 非技術者によるノーコードのデータクレンジングとプロファイリング
- No.46 コールセンター通話ログの Athena パーティション設計
- No.59 S3から取り込むデータの増分処理を実現するAWS Glueの構成
- No.64 Glueクローラーの自動起動によるデータカタログの鮮度維持
- No.77 コーディングなしでのデータクレンジングツールの選定
- No.89 Step Functionsで起動するGlueジョブが実行できない原因の切り分け
- No.91 Kinesis から Redshift Serverless への低運用負荷な近リアルタイム取り込み
- No.106 Athena クエリのスキャン量削減とパーティション設計
- No.109 分析対象データの行・列レベル制限付きクロスアカウント共有
- No.110 S3上のデータに対するサーバーレスな対話型クエリ
- No.114 データレイクにおける重複レコードの除去方式
- No.115 DynamoDB テーブルデータの自動削除
- No.117 複数の RDS から Redshift への継続的レプリケーション
- No.122 データメッシュ実装に適したAWSサービスの組み合わせ
- No.125 AWS Glue によるパイプラインのオーケストレーション
- No.126 Athenaクエリ用データカタログの差分クロール
- No.127 AWS Glueによる重複商品データの名寄せ
- No.137 Glue ETL パイプラインの IaC 自動化
- No.145 限られた列だけを使った異常検知基盤の構築
- No.150 AWS GlueによるPIIの自動検出と保護
- No.151 データレイクにおける行・列単位のきめ細かいアクセス制御
- No.153 生データゾーンと加工済みゾーンのストレージコスト最適化
- No.162 Athena の長時間クエリを日次で連鎖実行する構成
- No.165 複数データソースへの横断的な SQL クエリ基盤
- No.172 順次実行する Glue ジョブの失敗検知と停止
- No.174 AWS Glue ジョブの実行時間短縮
- No.177 サーバーレスETLパイプラインのIaCデプロイと自動スケーリング
- No.185 サーバー管理不要な月次バッチスクリプトの実行方式の選定
- No.194 RDSの古いデータをS3へアーカイブする運用負荷最小の自動化
- No.198 Lambda と Glue ジョブの低運用負荷なオーケストレーション
- No.208 夜間バッチ用 EMR クラスターの高可用性とデータ永続化
- No.211 オンプレミスからS3への継続的な差分データ転送の自動化
- No.212 スキーマ変化を自動検知する ETL パイプライン
- No.222 AWS Glue ジョブの認証情報管理の是正
- No.223 AWS Glue DataBrew によるデータクレンジング
- No.236 増分データのみを取り込むステートフルな ETL
- No.237 リアルタイムログ分析と全文検索に適したマネージドサービス
- No.244 S3間ETLのためのマネージドSpark基盤選定
- No.246 S3からRedshiftへの増分データ取り込み
- No.248 S3データの変換とAuroraへの負荷を抑えたロード
- No.250 AWS Glue DataBrewによるコード不要のデータ整形自動化
- No.252 Athenaのパーティション過多によるクエリ遅延の緩和
- No.254 Excelファイルの複数列をJSON形式の1列にまとめる最小工数の方法
- No.266 定期実行ETLパイプラインの最小運用オーケストレーション
- No.272 Athenaの結合クエリのパフォーマンス最適化
- No.277 DataBrew での結合フィールドの分割
- No.279 AWS Glue によるログの列指向変換パイプライン
- No.281 データパイプラインのデプロイ自動化とIaC
- No.283 Lake Formationによる部門別アクセス制御を備えたデータレイク構築
- No.286 小規模CSVの日次ETLに最もコスト効率の良いGlueジョブタイプ
- No.288 Athenaのクエリ結果を新規テーブル無しでORC出力する方法
- No.290 配送伝票データの結合列分割と日次自動化
- No.302 S3上のParquetから単一列を低運用負荷で抽出
- No.326 AWS Glue ジョブのオートスケーリングによるコスト最適化
- No.329 住宅ローン審査データのPIIを最小運用負荷でプロファイル・マスキング
- No.332 Glueジョブブックマークによる再処理トラブルの原因究明
- No.341 日次データ抽出パイプラインの設計
- No.353 チーム別のクエリコスト管理と分析基盤の分離
- No.372 リアルタイムストリームでの異常検知に適したAWSサービス
- No.379 Excel データの対話的な前処理を行うサーバーレス構成
- No.390 Glueによる個人情報の自動検出とマスキング
- No.391 S3データレイクの生データに対するアドホックSQL品質チェック
- No.395 Glue ジョブブックマークによる増分ETL処理
- No.400 データレイクパーティションのGlueカタログ低遅延同期
- No.412 複数データソースを統合したダッシュボードの最短構築方法
- No.413 CSV から列指向形式への自動変換パイプライン
- No.416 S3 から Redshift への日次データロードの自動化
- No.425 DynamoDB データへの低運用負荷なアクセス
- No.429 Excelファイルのユニーク件数集計を最小運用負荷で実現
- No.432 Lake Formation によるデータレイクのカタログ化とアクセス制御
- No.434 AWS Glue ETL ジョブのコスト最適化
- No.435 日次バッチETLのAWS Glueによる自動化構成
- No.451 サーバーレスなETLジョブ管理サービスの選定
- No.484 大量テーブルのデータ品質ルールセットを短期間で用意する
- No.485 品質ルールに違反した行だけを隔離するETLジョブ
- No.486 しきい値を割らずに進行するデータ量の異常の検知
- No.487 データ品質スコアの劣化を運用チームへ自動通知する
- No.488 タイムゾーンをまたぐ多数のバッチ起動の一元管理
- No.489 夜間ETLジョブの失敗を即座に検知して自動対応する
- No.491 失敗したGlueジョブの原因をスクリプトの行単位で特定する
- No.494 巨大テーブルと小テーブルの結合でシャッフルを避ける
- No.497 クラスターごとに分断されたHiveメタストアの統合
- No.498 数十万パーティションのテーブルでクエリ計画が遅い
- No.499 ストリーミングのスキーマ進化でコンシューマーを壊さない
広告