Questão nº 71

Questão de Ciência de Dados · FGV TCE-PA 2024 (nº 71)

FGV2024Auditor de Controle Externo - Administrativa - Ciência de DadosCiência de Dados
Gabarito: Dver comentário ↓

A eficiência no armazenamento de dados é crucial para muitas organizações. Tecnologias como Amazon S3, CEPH e HDFS apresentam soluções adequadas a diferentes necessidades.
Sobre esses modelos de armazenamento, avalie as afirmativas a seguir.
I. O Amazon Simple Storage Service utiliza um sistema de arquivos distribuídos, o que proporciona uma escalabilidade praticamente ilimitada.
II. O modelo CEPH é indicado para organizações que lidam com dados altamente sensíveis, como informações financeiras, jurídicas ou dados governamentais.
III. Dividir arquivos grandes em blocos de tamanho fixo aumenta a eficiência do HDFS no processamento de grandes volumes de dados, ou Big Data.
Está correto o que se afirma em

Resposta comentada

Gabarito Alternativa D

Sistemas de armazenamento distribuído são como grandes bibliotecas onde os livros (dados) são guardados em vários locais (servidores) ao mesmo tempo, para que possam ser acessados rapidamente e para garantir que não se percam se um local falhar.

  • (A) Incorreta: O Amazon S3 é um serviço de armazenamento de objetos, não um sistema de arquivos distribuídos no sentido tradicional (como HDFS ou CephFS). Embora seja distribuído e escalável, ele não oferece uma interface de sistema de arquivos POSIX diretamente.
  • (B) Incorreta: A alternativa I está incorreta, conforme explicado acima.
  • (C) Incorreta: A alternativa III está correta, mas a II também está, tornando esta opção incompleta.
  • (D) Correta:
    • II. O modelo CEPH é indicado para organizações que lidam com dados altamente sensíveis, como informações financeiras, jurídicas ou dados governamentais. Ceph é uma solução de armazenamento definida por software que pode ser implementada on-premise (em infraestrutura própria), oferecendo controle granular sobre a segurança, conformidade e residência dos dados. Isso é crucial para dados sensíveis que exigem rigorosos requisitos regulatórios e de privacidade, permitindo que as organizações mantenham total soberania sobre suas informações.
    • III. Dividir arquivos grandes em blocos de tamanho fixo aumenta a eficiência do HDFS no processamento de grandes volumes de dados, ou Big Data. Esta é uma característica fundamental do HDFS. Ao dividir arquivos grandes em blocos menores e distribuí-los por vários nós, o HDFS permite que as tarefas de processamento (como as do MapReduce) sejam executadas em paralelo, próximo aos dados (localidade de dados), o que reduz a movimentação de dados pela rede e acelera significativamente o processamento de Big Data.
  • (E) Incorreta: A alternativa I está incorreta.

Fonte: FGV TCE-PA 2024 Auditor de Controle Externo - Administrativa - Ciência de Dados (Caderno Tipo 1). Reproduzida para fins de estudo.

Continue estudando

Estudar é izi

Pratique milhares de questões como esta, de graça, com explicação e gamificação no Quizinho.

Estudar de graça no Quizinho