A respeito de banco de dados, julgue o item seguinte.O ETL (...

Próximas questões
Com base no mesmo assunto
Q4234393 Banco de Dados

A respeito de banco de dados, julgue o item seguinte.


O ETL (extract, transform, and load) é um processo de integração de dados que tem alto custo computacional. 

Alternativas

Comentários

Veja os comentários dos nossos alunos

ELT

Baixo custo por gigabyte, focado em armazenamento em massa.

ETL

Custo mais alto por gigabyte, focado em alta performance de consulta.

ETL (Extração, Transformação, Carga (ou carregamento) posterior – Usa Data Warehouse

ELT (Extração, Carga (ou carregamento), Transformação posterior – Usa Data Warehouse e Data Lake também

cuidado: dizer que "ETL sempre tem alto custo computacional" seria uma generalização exagerada. O custo depende do volume, complexidade das transformações e infraestrutura.

Se a questão simplesmente afirma que ETL pode ter alto custo computacional em grandes volumes de dados, está correta.

A afirmação está correta.

O processo de ETL (Extract, Transform, Load) possui alto custo computacional devido à complexidade e ao volume das operações executadas em suas três etapas principais:

  • Extração (Extract): Leitura de grandes volumes de dados oriundos de múltiplas fontes heterogêneas (bancos relacionais, APIs, arquivos de log, sistemas legados), gerando alto consumo de I/O (entrada/saída) de rede e de disco.

  • Transformação (Transform): Etapa de maior demanda de processamento (CPU e memória RAM), pois realiza limpeza, cruzamento de dados (joins), deduplicação, padronização, agregações complexas e conversão de tipos de dados antes da carga final.

  • Carga (Load): Inserção massiva de dados transformados no ambiente de destino (como Data Warehouses), exigindo alta capacidade de gravação e indexação no banco de dados receptor.

Para mitigar esse impacto computacional em cenários de Big Data, abordagens modernas frequentemente utilizam o ELT (em que as transformações ocorrem diretamente no destino usando o poder de processamento distribuído da nuvem) ou processamento paralelo via motores como Apache Spark.

Sei não hein... a questão não disse que PODE ter alto custo computacional, ela diz que o tem alto custo computacional.

Acho controverso, nem todo processo de ETL é custoso

Clique para visualizar este comentário

Visualize os comentários desta questão clicando no botão abaixo