

Seu próximo nível começa aqui
Seu desenvolvimento não pode ter limites. Garanta sua Assinatura Ilimitada e libere uma preparação completa com os melhores professores do Brasil.
Uma equipe de um Tribunal Regional do Trabalho está desenvolvendo um modelo preditivo para avaliar o tempo de tramitação de processos trabalhistas. Os dados estão armazenados em um arquivo CSV chamado “processos.csv”, com as seguintes colunas:
- id_processo: Identificador único do processo.
- data_abertura: Data em que o processo foi aberto.
- data_encerramento: Data em que o processo foi encerrado.
A equipe deseja calcular o tempo de tramitação (em dias) de cada processo e inseri-lo em uma nova coluna chamada tempo_tramitacao. Considerando que o arquivo foi carregado em um dataframe chamado dados, o comando R que realiza corretamente esta tarefa é:
dados$tempo_tramitacao <- (as.Date (dados$data_encerramento) -
as.Date (dados$data_abertura)).days
dados$tempo_tramitacao <- difftime(dados$data_abertura, dados$data_encerramento, units = “days”)
dados$tempo_tramitacao <- as.numeric(as.Date(dados$data_encerramento) - as.Date (dados$data_abertura))
dados <- transform(dados, tempo_tramitacao = dados$data_encerramento - dados$data_abertura)
dados <- mutate(dados, tempo_tramitacao = dados$data_abertura - dados$data_encerramento)