Farei raspagem de web com python, automação e extração de dados de pdf
Analista de informações
Sobre este Serviço
Você está enfrentando dificuldades com dados não estruturados, copiar e colar manualmente ou PDFs complexos de várias páginas?
Eu crio scripts personalizados de automação em Python e pipelines de extração de dados para transformar dados complexos em planilhas Excel limpas, estruturadas ou bancos de dados.
Como profissional de Ciência da Computação, especializo-me em raspagem de web, parsing de documentos e engenharia de dados usando bibliotecas robustas de Python.
️ O que posso fazer por você:
- Raspagem de Web: Raspagem de sites dinâmicos, portais e listagens (Playwright, Selenium, BeautifulSoup)
- Extração de PDFs e Documentos: Parsing de tabelas complexas, blocos de texto e faturas (PyMuPDF, RegEx)
- Limpeza de Dados & ETL: Mesclar, limpar, deduplicar e formatar conjuntos de dados (Pandas, OpenPyXL)
- Verificação Web: Conferir automaticamente registros extraídos contra portais web ao vivo
O que você receberá:
- Arquivos Excel (.xlsx) ou CSV prontos para publicação
- Dados estruturados 100% precisos e sem erros
- Código fonte Python reutilizável (.py ou .ipynb) mediante solicitação
Por que me escolher?
- Formação em Ciência da Computação garantindo código de alto desempenho
- Tempos de entrega rápidos via scripts automatizados
- Comunicação clara e soluções personalizadas
Por favor, envie uma mensagem com detalhes do seu projeto e arquivos de amostra antes de fazer seu pedido!
Obrigado :)
Meu portfólio
Perguntas frequentes
Tradução automática
Você consegue lidar com bloqueios de IP, CAPTCHAs ou proteções anti-scraping?
Sim. Eu crio raspadores resistentes usando Playwright e Selenium com cabeçalhos personalizados, atrasos controlados e rotação de proxy para lidar com renderização dinâmica, Cloudflare e verificações básicas de CAPTCHA com segurança.
