Eu vou extrair dados de pdf, faturas e documentos para Excel ou Google Sheets
Sobre este Serviço
Copiar números manualmente de PDFs é lento e cheio de erros. Eu vou criar um extrator em Python que lê seus PDFs, faturas, extratos ou formulários e coloca cada campo que você precisa em um arquivo Excel limpo, CSV ou Google Sheet.
Incluído: os dados extraídos, verificados com os arquivos originais, e nos pacotes Standard e Premium o script completo em Python com um README curto para você processar a próxima leva sozinho.
Funciona com PDFs de texto e com documentos escaneados (OCR), tabelas que atravessam várias páginas e diferentes layouts em uma mesma batch.
Como eu trabalho: envie dois ou três arquivos de exemplo e os campos que você quer antes de fazer o pedido. Eu confirmo o que pode ser extraído e te dou um resultado de teste com seus próprios exemplos.
Seus arquivos são usados apenas para seu pedido e são apagados após a entrega.
Tecnologia:
Excel
•
Planilhas Google
•
Python
Perguntas frequentes
Tradução automática
Você consegue ler PDFs escaneados ou fotos de documentos?
Sim. Arquivos escaneados passam por OCR primeiro. Escaneamentos claros oferecem os melhores resultados; eu verifico a saída com os originais e aviso sobre qualquer campo que não pôde ser lido com confiabilidade.
O que você precisa de mim?
Dois ou três arquivos de exemplo, a lista de campos que você quer (por exemplo, número da fatura, data, fornecedor, total, itens), quantos arquivos no total e o formato de saída.
Eu recebo o roteiro?
Nos pacotes Standard e Premium você recebe o script em Python e um README, assim você pode rodar a próxima batch sozinho sem precisar fazer outro pedido.
Meus dados estão seguros?
Seus arquivos são usados apenas para seu pedido, nunca compartilhados e apagados após a entrega. Se seus documentos contiverem dados pessoais, me avise que eu vou mascarar os campos que você escolher.

