Questão nº 72
Questão de Banco de Dados e Ciência de Dados · CEBRASPE STM 2025 (nº 72)
Acerca de deep learning, de Big Data e de redes neurais, julgue os itens subsequentes.
Em um ambiente de Big Data, a função do HDFS (Hadoop distributed file system) é caracterizada por armazenar grandes volumes de dados de forma distribuída e tolerante a falhas.
Resposta comentada
O HDFS (Hadoop Distributed File System) é o "sistema de arquivos" do ecossistema Hadoop: ele pega arquivos gigantes, quebra em blocos e espalha esses blocos por várias máquinas do cluster. Além disso, mantém réplicas (normalmente 3 cópias) de cada bloco em nós diferentes — se uma máquina cair, os dados continuam acessíveis em outra. Isso é exatamente o que significa distribuído (dados espalhados por vários nós) e tolerante a falhas (o sistema sobrevive à perda de máquinas).
- Correta: Certo. O HDFS foi projetado justamente para armazenar volumes massivos de dados de forma distribuída entre nós e resiliente a falhas de hardware, via replicação de blocos.
Fica de olho: a banca costuma trocar a característica central do HDFS por outra que NÃO é dele — por exemplo, dizer que o HDFS é "otimizado para leitura e escrita aleatória de baixa latência" (errado: ele é otimizado para leitura sequencial e write-once, read-many, com alta latência) ou que ele "processa os dados" (errado: quem processa é o MapReduce/Spark; o HDFS só armazena). Também aparece a pegadinha de dizer que o HDFS "não replica dados" ou que "tolera falhas sem replicação" — ambas erradas.
Fonte: CEBRASPE STM 2025 Analista Judiciário – Área: Apoio Especializado – Especialidade: Suporte em Tecnologia da Informação. Reproduzida para fins de estudo.