Questão 5 — Simulado AWS Certified Data Engineer – Associate (DEA-C01) | Questões Atualizadas

Uma empresa precisa carregar dados de clientes provenientes de terceiros em um data warehouse do Amazon Redshift. A empresa armazena dados de pedidos e dados de produtos no mesmo data warehouse. A empresa deseja usar o conjunto de dados combinado para identificar novos clientes em potencial. Um engenheiro de dados percebe que um dos campos nos dados de origem inclui valores que estão no formato JSON. Como o engenheiro de dados deve carregar os dados JSON no data warehouse com o MENOS esforço?
  • A. Use o tipo de dados SUPER para armazenar os dados na tabela do Amazon Redshift.
  • B. Use o AWS Glue para nivelar os dados JSON e ingeri-los na tabela do Amazon Redshift.
  • C. Use o Amazon S3 para armazenar os dados JSON. Use o Amazon Athena para consultar os dados.
  • D. Use uma função AWS Lambda para nivelar os dados JSON. Armazene os dados no Amazon S3.
Resposta correta: A

Explicação

Explicação: no Amazon Redshift, o tipo de dados SUPER foi projetado especificamente para lidar com dados semiestruturados como JSON, Parquet, ORC e ​​outros. Ao usar o tipo de dados SUPER, o Redshift pode ingerir e consultar dados JSON sem exigir processos complexos de nivelamento de dados, reduzindo assim a quantidade de pré-processamento necessária antes de carregar os dados. O tipo de dados SUPER também funciona perfeitamente com o Redshift Spectrum, permitindo consultas complexas que podem combinar conjuntos de dados estruturados e semiestruturados, o que se alinha com a necessidade da empresa de usar conjuntos de dados combinados para identificar potenciais novos clientes. O uso do tipo de dados SUPER também permite a análise automática e o processamento de consultas de estruturas de dados aninhadas por meio das expressões PARTITION BY e JSONPATH do Amazon Redshift, o que torna essa opção a abordagem mais eficiente com o menor esforço envolvido. Isso reduz a sobrecarga associada ao uso de ferramentas como AWS Glue ou Lambda para transformação de dados. : Documentação do Amazon Redshift - Tipo de dados SUPER AWS Certified Data Engineer - Associate Training: Building Batch Data Analytics Solutions on AWS AWS Certified Data Engineer - Associate Study Guide Ao aproveitar diretamente os recursos do Redshift com o tipo de dados SUPER, o engenheiro de dados garante a ingestão simplificada de JSON com esforço mínimo, mantendo a eficiência da consulta.
Quer todas as 289 questões por R$ 198,00?