Questão nº 24
Questão de Tecnologia da Informação · FGV TJ-MS 2024 (nº 24)
O analista Marcos recebeu o arquivo data.csv e precisa analisar o seu conteúdo por meio das seguintes informações:
quantidade de linhas e colunas;
lista das primeiras 5 linhas e das últimas 5 linhas;
nome e tipo das colunas.
Para isso, Marcos começou a desenvolver o seguinte trecho de código escrito em Python:
import pandas as pd
df = pd.read_csv('data.csv')
Para obter as informações de que precisa, Marcos deve usar os seguintes comandos:
print(myvar)
pd.options.display.min_rows = 5
pd.options.display.memory_usage = True
print(df)
print(df)
- Amyvar = pd.Series(df)
- Bpd.options.display.max_rows = 5
- Cprint(df.head(), df.tail(), df.info()) (alternativa correta)
- Ddf.corr()
- Eprint(pd.DataFrame(data))
Resposta comentada
Gabarito Alternativa C
Um DataFrame do Pandas é como uma tabela de dados, e existem funções específicas para rapidamente ver seu tamanho, as primeiras e últimas linhas, e os tipos de dados de cada coluna.
- (A) Incorreta:
pd.Series(df)tenta converter o DataFrame inteiro em uma única Série, o que não é o objetivo e não fornece as informações solicitadas. - (B) Incorreta:
pd.options.display.max_rows = 5é uma configuração que limita o número de linhas exibidas por padrão quando você imprime um DataFrame, mas não é um comando para obter explicitamente as primeiras 5, últimas 5, ou as informações de tipo e quantidade. É uma armadilha, pois mexe com a exibição de linhas, mas não entrega o que foi pedido de forma direta. - (C) Correta:
df.head()mostra as primeiras 5 linhas,df.tail()mostra as últimas 5 linhas, edf.info()exibe um resumo completo, incluindo a quantidade de linhas e colunas, nomes das colunas e seus tipos de dados. Juntos, esses comandos fornecem todas as informações que Marcos precisa. - (D) Incorreta:
df.corr()calcula a correlação entre as colunas numéricas do DataFrame, o que é uma análise estatística e não o que foi pedido para inspecionar a estrutura do arquivo. - (E) Incorreta:
pd.DataFrame(data)tenta criar um novo DataFrame a partir de uma variáveldataque não existe no contexto, e o objetivo é analisar o DataFramedfjá carregado.
Fonte: FGV TJ-MS 2024 Técnico de Nível Superior - Analista de Banco de Dados (Caderno Tipo 1). Reproduzida para fins de estudo.