Vou limpar e preparar seu conjunto de dados para análise ou modelagem
Cientista de dados
Sobre este Serviço
Dados sujos levam a análises pouco confiáveis. Antes de qualquer EDA, visualização, modelo ou decisão de negócio, seu conjunto de dados precisa ser confiável e isso começa com uma limpeza e preparação adequadas ao tipo de dado com que você está trabalhando.
O que vou cuidar:
- Valores ausentes: detecção, imputação ou remoção justificada
- Duplicatas e registros inconsistentes
- Correções de tipos de dados e padronização de formatação
- Detecção e tratamento de outliers
- Renomear variáveis e reorganização estrutural
- Normalização / padronização (Standard ou Premium)
- Codificação categórica e preparação de features (Premium)
- Qualquer outra técnica que eu considerar necessária, dado o contexto dos dados e o uso desejado para o conjunto.
Posso trabalhar em Python ou R. Você receberá, em qualquer um dos pacotes, código limpo, bem documentado, para que o processo seja totalmente reproduzível e audível, além de uma descrição escrita de cada passo realizado.
Se houver dúvidas ou perguntas sobre por que determinado passo foi feito, posso explicar sem problema algum.
Perguntas frequentes
Tradução automática
Meu conjunto de dados contém informações sensíveis. É seguro compartilhar?
Eu trato todos os dados dos clientes com confidencialidade rigorosa e uso-os exclusivamente para o escopo de trabalho acordado. Anonimizo os dados se necessário. Após a conclusão do trabalho, excluo qualquer dado relacionado a ele.
Quais formatos de arquivo você aceita?
CSV, Excel (xlsx/xls), bancos de dados R (Rdata), parquets,... Qualquer formato tabular plano.

