Questão 39 — Certificação AWS Solutions Architect Associate SAA-C03
Uma empresa está construindo um aplicativo sem servidor para processar dados de fluxo de cliques de seu site. Os dados de clickstream são enviados para um fluxo de dados do Amazon Kinesis Data Streams dos servidores web do aplicativo. A empresa deseja enriquecer os dados de clickstream unindo-os aos dados de perfil do cliente de um banco de dados Amazon Aurora Multi-AZ. A empresa quer usar o Amazon Redshift para analisar os dados enriquecidos. A solução deve estar altamente disponível. Qual solução atenderá a esses requisitos?
- A. Use uma função AWS Lambda para processar e enriquecer os dados de clickstream. Use a mesma função Lambda para gravar os dados de clickstream no Amazon S3. Use o Amazon Redshift Spectrum para consultar os dados enriquecidos no Amazon S3.
- B. Use uma instância spot do Amazon EC2 para pesquisar o fluxo de dados e enriquecer os dados do fluxo de cliques. Configure a instância do EC2 para usar o comando COPY para enviar os resultados enriquecidos ao Amazon Redshift.
- C. Use uma tarefa do Amazon Elastic Container Service (Amazon ECS) com capacidade AWS Fargate Spot para pesquisar o fluxo de dados e enriquecer os dados do fluxo de cliques. Configure uma instância do Amazon EC2 para usar o comando COPY para enviar os resultados enriquecidos ao Amazon Redshift.
- D. Use o Amazon Kinesis Data Firehose para carregar os dados de clickstream do Kinesis Data Streams para o Amazon S3. Use rastreadores do AWS Glue para inferir o esquema e preencher o catálogo de dados do AWS Glue. Use o Amazon Athena para consultar os dados brutos no Amazon S3.
Resposta correta:
A
Explicação
Explicação: A opção A é a melhor solução, pois aproveita o AWS Lambda para processamento e enriquecimento de dados de fluxo de cliques sem servidor, escalável e altamente disponível. O Lambda pode processar os dados em tempo real, juntá-los aos dados do banco de dados Aurora e gravar os resultados enriquecidos no Amazon S3. Do S3, o Amazon Redshift Spectrum pode consultar diretamente os dados enriquecidos sem a necessidade de carregá-los no Redshift, permitindo eficiência de custos e alta disponibilidade. Por que outras opções estão incorretas: Opção B:As instâncias spot do EC2 não têm garantia de alta disponibilidade, pois as instâncias spot podem ser interrompidas a qualquer momento. Isso não está alinhado com o requisito de alta disponibilidade. Opção C:Embora o ECS com AWS Fargate forneça escalabilidade, o uso do EC2 para o comando COPY introduz sobrecarga operacional e compromete a alta disponibilidade. Opção D:Kinesis Data Firehose e Athena são adequados para consultar dados brutos, mas não oferecem suporte direto ao enriquecimento dos dados por meio da união com o Aurora. Esta solução não atende ao requisito de enriquecimento de dados. Principais recursos da AWS usados: AWS Lambda: processamento sem servidor em tempo real com recursos de integração para Aurora e S3. Amazon S3: armazenamento econômico para dados enriquecidos. Amazon Redshift Spectrum:consulta direta de dados armazenados no S3 sem carregá-los no Redshift. Referência da documentação da AWS: Visão geral da função AWS Lambda Amazon Redshift Spectrum Processando dados de streaming com Kinesis Data Streams
Quer todas as 879 questões por R$ 198,00?