Eu vou extrair dados estruturados de PDFs para Excel CSV e json
Desenvolvedor de automações em Python e IA local
Sobre este Serviço
Eu vou extrair dados estruturados de documentos PDF com texto nativo e entregá-los em um formato limpo e reutilizável.
Posso extrair campos específicos de faturas, relatórios, formulários, extratos e outros PDFs estruturados ou semi-estruturados para Excel, CSV ou JSON, dependendo do pacote escolhido.
Meu fluxo de trabalho pode incluir:
Extração de dados baseada em campos
Saída em Excel e CSV
Saída em JSON nos planos Standard e Premium
Referências de página para os valores extraídos
Avisos de valores ausentes ou inválidos
Validação de dados
Relatório de QA e entrega em ZIP organizado
Regras de validação personalizadas no plano Premium
Eu não adivinho valores ausentes. Se um valor não puder ser encontrado de forma confiável, ele será deixado em branco ou marcado para revisão.
Este serviço é destinado a PDFs com texto nativo. OCR, documentos manuscritos, arquivos protegidos por senha, login em contas, integração com API e acesso a sistemas de produção não estão incluídos.
Por favor, envie os PDFs, os campos exatos que deseja extrair e seu formato de saída preferido.
Toda comunicação e entrega podem ser feitas de forma assíncrona pelo Fiverr.
Tecnologia:
Excel
•
Python
Meu portfólio
Perguntas frequentes
Tradução automática
Que tipos de arquivos PDF você suporta?
Supporto PDFs com texto nativo onde o texto pode ser selecionado ou copiado. PDFs escaneados com imagem e documentos manuscritos que requerem OCR não estão incluídos.
Quais formatos de saída vocês fornecem?
Excel e CSV estão disponíveis em todos os pacotes. A saída em JSON está incluída nos planos Standard e Premium.
Você consegue extrair campos específicos que eu escolher?
Sim. Por favor, forneça os nomes exatos dos campos que deseja extrair, como número da fatura, data, nome da empresa, valor total, email ou outros campos específicos do documento.
Você fornece referências de página?
Sim. Os valores extraídos podem incluir a origem no PDF e a referência de página, para que você possa rastrear de onde cada valor veio.
O que acontece se um valor não puder ser encontrado?
Eu não invento ou adivinho valores ausentes. O campo ficará em branco ou será marcado para revisão, dependendo do resultado da extração e validação.
Você consegue validar os dados extraídos?
Sim. Os planos Standard e Premium incluem avisos de validação. O plano Premium também pode incluir regras de validação personalizadas conforme suas necessidades.
Você suporta PDFs escaneados ou OCR?
Não. Este serviço atualmente é limitado a PDFs com texto nativo. Escaneamentos apenas de imagem e documentos manuscritos que requerem OCR estão fora do escopo suportado.
Você consegue acessar minha conta, site, API ou banco de dados?
Não. Este serviço é baseado apenas em arquivos. Não requiro login em contas, acesso a API, banco de dados ou sistemas de produção.
Precisamos de uma videochamada ou reunião?
Não. Todo o projeto pode ser gerenciado de forma assíncrona por mensagens e troca de arquivos pelo Fiverr.
O que devo enviar antes de começar o pedido?
Por favor, envie os PDFs de origem, os campos exatos que deseja extrair, seu formato de saída preferido e quaisquer regras de validação ou exemplos de saída que queira que eu siga.

