Eu vou extrair tabelas de PDF ou relatórios digitalizados para Excel limpo
Análise de dados
Nível 1
Atendeu a determinados critérios de desempenho e demonstra forte potencial no marketplace.
Sobre este Serviço
Envie-me um PDF baseado em texto ou digitalizado e retornarei um arquivo Excel estruturado e limpo, com todas as tabelas extraídas, devidamente tipadas e mescladas em uma única planilha.
O que você recebe:
- Um arquivo .xlsx limpo com uma aba por tabela fonte (ou mescladas em uma única tabela organizada, se preferir)
- Cabeçalhos normalizados, tipos corrigidos (números, datas, moedas)
- Coluna de referência da página fonte para você poder auditar a extração
- Opcional: uma aba de "validação" marcando linhas de baixa confiança
Eu extraio de:
- Demonstrações financeiras, relatórios anuais, 10-Ks
- Arquivos governamentais / regulatórios
- Artigos acadêmicos (tabelas e listas de referências)
- Faturas e recibos
- Relatórios científicos e white papers
- Listagens de propriedades e catálogos
- PDFs de resultados de pesquisas
Tanto PDFs baseados em texto quanto PDFs digitalizados são processados com OCR incluído quando necessário, sem custo adicional.
Por que sou rápido: detecção de tabelas assistida por IA e OCR + QA humano. A maioria dos pedidos é enviada no mesmo dia para até 50 páginas.
Coloque o PDF nos requisitos do pedido com uma linha dizendo quais tabelas você precisa (ou "todas"). Eu cuido do resto.
Tipo:
Converter dados
•
Inserir dados
•
Transcrição
•
Limpeza de dados
Ferramenta:
Excel
•
Planilhas Google
•
Documentos Google
Perguntas frequentes
Tradução automática
O que está incluso no pacote básico?
(1) Até 10 páginas; (2) PDFs baseados em texto apenas (sem OCR); (3) Uma tabela por página; (4) saída em .xlsx limpa; (5) referência da página fonte
O que está incluído no pacote padrão?
(1) Até 50 páginas; (2) PDFs de texto ou digitalizados (OCR incluído); (3) Múltiplas tabelas por página; (4) cabeçalhos normalizados, correção de tipos; (5) mesclagem opcional em uma única tabela organizada; (6) aba de validação marcando linhas de baixa confiança
O que está incluído no pacote premium?
(1) Até 200 páginas; (2) PDFs de texto ou digitalizados (OCR incluído); (3) Tabelas complexas de várias páginas, tratamento de notas de rodapé, tabelas rotacionadas; (4) limpeza completa + validação; (5) script Python reutilizável para repetir a extração em PDFs similares no futuro; (6) README de instruções
Meu documento ficará privado?
Sim — Eu nunca compartilho ou reutilizo arquivos de clientes. NDA disponível mediante solicitação.
Meu PDF tem anotações manuscritas — você consegue extrair?
Texto impresso e a maioria das escritas limpas, sim. Escrita grosseira é de melhor esforço e será marcada. Me envie uma mensagem primeiro com uma página de exemplo.
Você consegue extrair apenas tabelas específicas, não todas?
Sim — liste os números das tabelas ou páginas que você precisa.
Você consegue lidar com PDFs em idiomas que não sejam o português?
Sim — a maioria dos principais idiomas latinos e CJK. Me informe o idioma de origem logo no começo.
Meus PDFs chegam mensalmente — você consegue configurar algo automático?
O nível premium inclui um script Python que você pode rodar em novos PDFs do mesmo modelo. Para automação completa (monitor de arquivos, função na nuvem), envie uma mensagem para um orçamento personalizado.
Meu PDF tem mais de 200 páginas. É possível?
Sim, envie uma mensagem para um orçamento personalizado — normalmente $1,50 por página para PDFs de texto, $2,50 por página para digitalizados.

