Eu vou extrair tabelas de PDF para Excel ou CSV com referências da página de origem

Algumas informações foram traduzidas automaticamente.

China

Eu falo Chinês, Inglês

Desenvolvedor Full Stack para automação em Python e web scraping

Desenvolvedor full-stack focado em automação com Python, fluxos de trabalho com PDF e planilhas, limpeza de dados, extração de dados da web, correção de bugs e integrações de API. Entrego resultados e...
Sobre este Serviço

Vou extrair tabelas de PDFs baseados em texto para arquivos Excel ou CSV limpos. Cada linha de saída inclui o nome do arquivo de origem e o número da página, a menos que você peça para omiti-los. Posso lidar com tabelas de várias páginas, cabeçalhos repetidos, páginas rotacionadas e marcar claramente as linhas que precisam de revisão.


Todos os pacotes incluem saída estruturada e validação básica. Os pacotes padrão incluem uma tabela mesclada, lista de exceções e resumo de QA. O pacote premium também inclui um fluxo de trabalho reutilizável de linha de comando local e README para arquivos futuros.


Por favor, envie amostras representativas antes de fazer o pedido para que eu possa confirmar o layout e as verificações de aceitação. PDFs digitalizados ou apenas de imagem, escrita manual, arquivos criptografados e layouts altamente irregulares não estão incluídos, a menos que seja acordado em uma oferta personalizada. Faça upload apenas de arquivos que você tem autorização para compartilhar.


Posso usar Python e ferramentas assistidas por IA quando permitido. Cada entrega é personalizada e revisada. Me avise antes de pedir se seu fluxo de trabalho precisa ser não IA ou apenas local.

Tecnologia:

Excel

Python

Especialidade:

Extração de dados

Manipulação de dados

Meu portfólio