O processo de ETL (Extração, Transformação e Carga) é funda...

Próximas questões
Com base no mesmo assunto
Q3255752 Banco de Dados
O processo de ETL (Extração, Transformação e Carga) é fundamental para integrar dados provenientes de diferentes fontes em um data warehouse, viabilizando análises e tomada de decisões baseadas em informações consolidadas. Acerca do ETL, marque (V), para as afirmativas verdadeiras, e (F), para as falsas.

(__) O processo de transformação no ETL inclui atividades como limpeza, deduplicação e normalização dos dados para adequá-los ao modelo de destino.
(__) A etapa de extração no ETL sempre envolve a transferência de dados em tempo real, diretamente das fontes para o destino final.
(__) A etapa de carga no ETL pode ser realizada de forma incremental ou total, dependendo das exigências do negócio e da natureza dos dados.
(__) O ETL é projetado para suportar dados de fontes heterogêneas, como sistemas transacionais, APIs e arquivos estruturados, consolidando-os em um único repositório.

A sequência está correta em:
Alternativas

Gabarito comentado

Confira o gabarito comentado por um dos nossos professores

Alternativa Correta: A - V − F − V − V.

O tema central dessa questão é o processo de ETL (Extração, Transformação e Carga), fundamental para integrar dados de diferentes fontes em um Data Warehouse. O ETL é crucial para garantir que os dados estejam prontos para análises sofisticadas e para apoiar a tomada de decisões informadas.

Agora, vamos compreender cada afirmativa:

1. O processo de transformação no ETL inclui atividades como limpeza, deduplicação e normalização dos dados para adequá-los ao modelo de destino. - Verdadeiro. Na transformação, os dados são preparados e ajustados para se adequar ao formato necessário do Data Warehouse. Isso inclui limpeza (remoção de dados desnecessários ou corruptos), deduplicação (eliminação de registros duplicados) e normalização (ajuste de dados para padrões de armazenamento consistentes).

2. A etapa de extração no ETL sempre envolve a transferência de dados em tempo real, diretamente das fontes para o destino final. - Falso. A extração pode ser realizada de várias formas, incluindo processos em tempo real ou em batch (lotes), dependendo das necessidades do sistema e das capacidades tecnológicas. Nem sempre é feito em tempo real, especialmente quando se lida com grandes volumes de dados.

3. A etapa de carga no ETL pode ser realizada de forma incremental ou total, dependendo das exigências do negócio e da natureza dos dados. - Verdadeiro. O método de carga pode ser incremental (apenas novos ou alterados dados são carregados) ou total (todos os dados são carregados), dependendo do que o negócio precisa para manter o Data Warehouse atualizado.

4. O ETL é projetado para suportar dados de fontes heterogêneas, como sistemas transacionais, APIs e arquivos estruturados, consolidando-os em um único repositório. - Verdadeiro. O ETL é flexível e desenvolvido para integrar dados de diversas fontes, sejam elas sistemas legados, APIs ou arquivos de diferentes formatos, unificando-os para a análise no Data Warehouse.

Compreender essas características do ETL é crucial para a implementação eficiente de um Data Warehouse e para garantir a integridade e a utilidade dos dados para a organização.

Gostou do comentário? Deixe sua avaliação aqui embaixo!

Clique para visualizar este gabarito

Visualize o gabarito desta questão clicando no botão abaixo

Comentários

Veja os comentários dos nossos alunos

De acordo com o texto do § 3º do Art. 4º da Resolução CNJ nº 574/2024, “o Conselho Nacional de Justiça poderá condicionar o acesso à API ao compromisso de o interessado oferecer aos magistrados e servidores do Poder Judiciário, de forma não onerosa e por meio da Plataforma Digital do Poder Judiciário (PDPJ-Br), os produtos desenvolvidos a partir dos dados consumidos do repositório centralizado do CNJ.”

  • aos magistrados e servidores do Poder Judiciário, de forma não onerosa e por meio da Plataforma Digital do Poder Judiciário (PDPJ-Br), os produtos desenvolvidos a partir dos dados consumidos do repositório centralizado do CNJ.

Essa exigência é uma contrapartida que pode ser imposta pelo CNJ para que terceiros tenham acesso às APIs de dados judiciais públicos consolidados.

Resposta: E

A etapa de extração no ETL sempre envolve a transferência de dados em tempo real, diretamente das fontes para o destino final.

A afirmação é falsa. A etapa de extração no (Extração, Transformação e Carga) raramente ocorre apenas em tempo real; ela geralmente utiliza processamento em lotes (batch) agendados, sendo os dados copiados para uma área de preparação (staging area) antes de serem transformados e carregados no destino final, diferentemente do , que carrega dados diretamente

A alternativa correta é a A (V − F − V − V).

Justificativas das Afirmativas

  • (V) O processo de transformação no ETL inclui atividades como limpeza, deduplicação e normalização dos dados para adequá-los ao modelo de destino. Esta afirmativa está correta. A etapa de transformação é responsável por aplicar regras de negócio, remover inconsistências, tratar valores nulos, padronizar formatos e deduplicar registros para garantir a qualidade dos dados que vão para o destino.

  • (F) A etapa de extração no ETL sempre envolve a transferência de dados em tempo real, diretamente das fontes para o destino final. Esta afirmativa está incorreta devido ao uso do termo absolutista "sempre" e à menção do destino final. A extração frequentemente ocorre em lotes (batch), de maneira agendada (por exemplo, execuções noturnas), e os dados extraídos normalmente são direcionados primeiro para uma área intermediária (staging area), e não diretamente para o Data Warehouse final.

  • (V) A etapa de carga no ETL pode ser realizada de forma incremental ou total, dependendo das exigências do negócio e da natureza dos dados. Esta afirmativa está correta. A carga total (full load) substitui toda a base de dados existente, enquanto a carga incremental (incremental load) insere ou atualiza apenas os registros novos ou modificados desde a última execução, otimizando o tempo de processamento.

  • (V) O ETL é projetado para suportar dados de fontes heterogêneas, como sistemas transacionais, APIs e arquivos estruturados, consolidando-os em um único repositório. Esta afirmativa está correta. Um dos principais objetivos do ETL é integrar dados provenientes de origens variadas e desconectadas (como bancos relacionais, NoSQL, arquivos CSV/JSON e APIs web) em uma visão única e unificada.

Resumo sobre ETL para Estudo

O ETL (Extract, Transform, Load ou Extração, Transformação e Carga) é um processo central na arquitetura de engenharia de dados e Business Intelligence (BI), servindo para mover, tratar e consolidar dados de sistemas operacionais voltados a transações (OLTP) para ambientes analíticos (OLAP), como Data Warehouses e Data Lakes.

  • Extração: Coleta de dados brutos diretamente das fontes de origem (bancos de dados legados, CRMs, ERPs, planilhas, arquivos de texto ou APIs). Pode ser feita em tempo real ou por lotes (batch).

  • Transformação: Etapa onde a inteligência e as regras de negócio são aplicadas. Os dados brutos passam por processos de limpeza (remoção de ruídos e erros), filtragem, conversão de tipos, validação de integridade, normalização e anonimização, garantindo que cheguem confiáveis e estruturados ao destino.

  • Carga: Gravação dos dados tratados no repositório final de armazenamento e consulta. Pode ocorrer de forma total (substituição completa) ou incremental (processando apenas alterações), viabilizando consultas rápidas, relatórios gerenciais e análises preditivas.

Clique para visualizar este comentário

Visualize os comentários desta questão clicando no botão abaixo