AWS認定資格 WEB問題集&徹底解説

AIプラクティショナー

正解 A問題
要復習(もう一度解きたい問題) 1 2 3 4
合格に向けて、もっと深く学習する
豊富な問題と詳細なAWSサービス解説を、24時間無料でお試しいただけます
プレミアム会員機能を無料で試す ❯
問題文と選択肢
ある保険会社は、顧客から提出される保険申請書類をデジタル処理する仕組みを構築したいと考えています。提出される書類は紙ベースの申請書や医師の診断書などで、これらの文書から契約者名、保険金額、診断内容といった重要項目を自動抽出し、さらに抽出されたデータが社内の承認基準に照らして適切かどうかを機械学習で判定する必要があります。運用開始後も判定精度を継続的に向上させていく予定です。この要件を満たすために最も適切なAWSサービスの組み合わせはどれですか。
  • Amazon Textract と Amazon SageMaker
  • Amazon Comprehend と AWS Lambda
  • Amazon Rekognition と Amazon Kendra
  • Amazon Lex と Amazon Polly
解説 頻出度★★★★★
この問題は、「紙・PDF からの項目抽出(OCR)」と「抽出データを判定するカスタム ML モデルの構築・継続改善」という 2 つの要件に、Amazon Textract と Amazon SageMaker をそれぞれ割り当てられるかがポイント
正解

A. Amazon Textract と Amazon SageMaker

Amazon Textract は、スキャンした紙文書や PDF から単なる文字列だけでなくフォーム(キーと値のペア)や表の構造を保ったままデータを抽出する機械学習ベースのサービスで、申請書や診断書から「契約者名」「保険金額」「診断内容」を取り出す要件にそのまま合致します。
Amazon SageMaker は ML モデルの構築・学習・デプロイを一貫して行えるサービスで、抽出データが社内の承認基準に適合するかを判定するカスタムモデルを作成でき、運用後の実績データで再学習して精度を継続的に向上させられます。
「文書からの項目抽出」+「独自基準の ML 判定と継続改善」という 2 要件を最短で満たすため、これが正解です。

B. Amazon Comprehend と AWS Lambda

Amazon Comprehend はテキストが入力前提の自然言語処理サービス(エンティティ抽出・感情分析・キーフレーズ抽出)で、紙や PDF の画像から文字を読み取る OCR 機能は持ちません。実際の構成でも Textract で読み取った後段に置くサービスです。
AWS Lambda はコードの実行基盤・オーケストレーションには使えますが、それ自体は判定モデルを学習・改善する仕組みではありません。文書入力と継続的な精度向上の両方を欠くため不適です。

C. Amazon Rekognition と Amazon Kendra

Amazon Rekognition は画像・動画分析(顔認識、物体・シーン検出、不適切コンテンツ検出)に特化しており、帳票のフォームや表を構造化して抽出する用途には向きません(文書からの抽出は Textract の担当)。
Amazon Kendra は自然言語での社内文書検索サービスで、「どの文書に書いてあるか」を探すのが役割です。項目抽出も、承認基準に照らした ML 判定モデルの構築もできません。

D. Amazon Lex と Amazon Polly

Amazon Lex は音声・テキストのチャットボット(会話型インターフェース)を作るサービス、Amazon Polly はテキストを音声に変換するサービスです。
どちらも文書からのデータ抽出とも、承認基準の ML 判定とも無関係で、本ユースケースの要件を 1 つも満たしません。

構成図

申請書・診断書(紙 / PDF)
   │
   ▼
Amazon Textract(フォーム・表を構造化データで抽出)
   │ 契約者名・保険金額・診断内容
   ▼
Amazon SageMaker(承認基準への適合判定モデル)──▶ 承認 / 要確認
   ▲ 再学習で精度を継続的に改善
これだけ覚える(記憶フック)
紙・PDF から項目を抜くなら Textract、自前モデルを作って育てるなら SageMaker。テキスト前提の Comprehend とは入口が違う。
正解への思考ルート 問題文から要件を抽出し、選択肢の適否を判断するのがポイントです。
要件 判断ポイント
紙ベースの申請書や診断書から重要項目を自動抽出したい 帳票・PDF からのキーと値・表の抽出は Amazon Textract の担当。テキスト前提の Comprehend、画像分析の Rekognition では読み取れない
→選択肢(B・C)を消す
抽出データが社内の承認基準に適合するかを機械学習で判定したい 社内独自の基準は既製 AI サービスに無いため、カスタムモデルを構築できる Amazon SageMaker が必要
→選択肢(A)は候補
運用開始後も判定精度を継続的に向上させたい 実績データでの再学習・再デプロイまで一貫して回せるのは SageMaker。Lambda は実行基盤であって学習基盤ではない
→選択肢(A)が正解
求められているのは「文書処理」と「ML 判定」の組み合わせ 会話ボット(Lex)や音声合成(Polly)は入出力のモダリティが異なり、どちらの要件にも関与しない
→選択肢(D)を消す
ひっかけポイント
  • 選択肢 B の Amazon Comprehend は「文書から情報を抽出する」と聞くと正解に見えるが、入力はあくまでテキスト紙・PDF の画像を読む OCR は Textract の役割で、Comprehend は Textract の後段に置くサービス
  • 選択肢 C の Amazon Rekognition も「画像を扱う」ため紛らわしいが、対象は顔・物体・シーン「文書の画像」なら Rekognition ではなく Textract と即断できるようにしておく
  • 「継続的に精度を向上させる」という一文は、既製 AI サービスだけでは足りず、カスタムモデル(SageMaker)が要ることを示すシグナル。この語が出たら SageMaker を含む選択肢を疑う
  • AWS Lambda は何にでも使えそうに見える万能札だが、要件が「ML モデルの構築・改善」なら Lambda 単体では成立しない。処理をつなぐ役であって、判定モデルそのものではない
出題バリエーション 同じ知識が本番では条件を変えて出題されます。
問題文がこう変わったら 正解はこう変わる
「抽出したテキストから感情や固有表現(人名・地名)を分析したい」 Amazon Textract + Amazon Comprehend の組み合わせが正解軸に。
「保険の医療文書から病名・投薬情報を抽出したい」 医療特化の Amazon Comprehend Medical が登場する。
「社内文書に対して自然文で質問して答えを探したい Amazon Kendra(または生成 AI なら Bedrock + RAG)が正解に。
モデルを自作せず、既存の学習済み AI サービスだけで済ませたい」 SageMaker ではなく Textract / Comprehend などのマネージド AI サービスのみの構成が正解軸に。
コールセンターの音声から要点を抽出したい」 Amazon Transcribe(音声→テキスト)+ Comprehend が正解軸に。入口が「音声」か「文書」かでサービスが変わる。
関連サービスの解説 Amazon SageMaker
Amazon Textract
+ 質問 / コメント
解答・解説に疑問がある場合や、よりよい解説がある場合など、お気軽にコメントください。ただし、短文コメントは表示されません。また、中傷などコメントの内容によっては、会員機能を停止させて頂きます。教え学び合える場になれば嬉しいです。(コメント投稿にはログインが必要です)
正答率 90%
No.14 解説
ある保険会社は、顧客から提出される保険申請書類をデジタル処理する仕組みを構築したいと考えています。提出される書類は紙ベースの申請書や医師の診断書などで、これらの文書から契約者名、保険金額、診断内容といった重要項目を自動抽出し、さらに抽出されたデータが社内の承認基準に照らして適切かどうかを機械学習で判定する必要があります。運用開始後も判定精度を継続的に向上させていく予定です。この要件を満たすために最も適切なAWSサービスの組み合わせはどれですか。
  • Amazon Textract と Amazon SageMaker
  • Amazon Comprehend と AWS Lambda
  • Amazon Rekognition と Amazon Kendra
  • Amazon Lex と Amazon Polly

(会員限定)当問題の評価をお願いします。改善に活用します。