Eu vou carregar conjuntos de dados Hugging Face e kaggle na sua base de dados
Engenheiro de Dados Experiente! Especialista em Pipeline de Dados! Migração de Dados
Sobre este Serviço
Precisa de um conjunto de dados público dentro da sua própria base? Eu vou puxá-lo do Hugging Face, Kaggle ou qualquer fonte de dados aberta, limpar e carregar na sua base de dados, data warehouse ou armazenamento na nuvem, pronto para consultar.
O que eu faço:
Extrair do Hugging Face, Kaggle, data.gov, AWS Open Data, BigQuery datasets públicos, APIs e arquivos CSV, JSON ou Parquet
Limpar e transformar: corrigir tipos de dados, achatar JSONs aninhados, remover duplicatas e linhas quebradas
Carregar em PostgreSQL, MySQL, SQL Server, MongoDB, Supabase, BigQuery, Snowflake, Redshift, Databricks, S3, GCS ou Azure
Transmitir grandes conjuntos de dados em lotes, para que o tamanho raramente seja um problema
Carregamentos incrementais e atualização agendada com Airflow, GitHub Actions ou cron
Conjuntos de dados de texto incorporados e carregados em pgvector, Pinecone ou Qdrant para IA e RAG
Você recebe:
- Tabelas prontas para consulta no seu armazenamento
- Código Python limpo e reutilizável
- Um README e um relatório de validação (contagem de linhas, esquema)
Verifico a licença de cada conjunto de dados e sinalizo quaisquer restrições antes de carregar.
Não tem certeza de qual pacote se encaixa? Envie o link do conjunto de dados e seu destino antes de pedir, e eu recomendarei um.

