Filtrar


Questões por página:
A respeito do Apache Hadoop, ecossistema muito usado no contexto de processamento de grandes volumes de dados, analise os itens a seguir.

I. O Hadoop MapReduce é um framework de software que facilita a criação de aplicações para processar vastas quantidades de dados (datasets de múltiplos terabytes) em paralelo, utilizando grandes clusters (milhares de nós) de hardware comum, de maneira confiável e tolerante a falhas.
II. O Hadoop Distributed File System (HDFS) é um sistema de arquivos distribuído, projetado para ser executado em hardware comum.
III. A ideia fundamental do YARN é dividir as funcionalidades de gerenciamento de recursos e o agendamento/monitoramento de tarefas em daemons distintos.

Está correto o que se afirma em
Assinale a opção correta no que se refere a dados estruturados e não estruturados, bem como a coleta, tratamento, armazenamento, integração e recuperação de dados.

Julgue o seguinte item, relativo a segurança da informação e Big Data.


Os Big Data são constituídos unicamente de grandes quantidades de dados estruturados armazenados em banco de dados relacionais e permitem, entre outros fatores, gerir, com velocidade e veracidade, esse volume de dados.

Com relação às arquiteturas de armazenamento e processamento de dados em larga escala, analise as afirmativas a seguir e assinale (V) para verdadeira e (F) para falsa.

( ) Os Data Lakes fundamentam-se no conceito de schema-onread, permitindo o armazenamento de dados em seu formato bruto sem a necessidade de uma estrutura rígida no momento da ingestão.
( ) Os Data Warehouses operam sob o modelo de schema-onwrite, exigindo que os dados sejam transformados e estruturados conforme um esquema definido antes de sua carga e disponibilização para consulta.
( ) Os Data Lakes são repositórios projetados exclusivamente para o armazenamento de dados não estruturados, sendo tecnicamente incompatíveis para dados estruturados provenientes de sistemas transacionais.

As afirmativas são, respectivamente,
Um Auditor está montando um fluxo de dados que extrai informações de um banco de dados SQL, de notas fiscais eletrônicas em formato JSON e de relatórios em PDF com texto livre.

Assinale a opção que indica a classificação desses três tipos de dados, respectivamente.