Vou construir pipelines de ETL escaláveis no databricks usando pyspark sql
Engenheiro de Dados e Criador de Sistemas de IA, com 10 anos de experiência
Sobre este Serviço
Você precisa de um pipeline confiável no Databricks em vez de notebooks frágeis e processamento manual de dados?
Sou engenheiro de dados com 9 anos de experiência profissional construindo pipelines de ETL, plataformas de dados e soluções de análise. Trabalho com Databricks, PySpark, Spark SQL, Delta Lake, Python e serviços de dados na nuvem para transformar dados brutos em conjuntos de dados limpos e prontos para análise.
Posso ajudar você com:
- Notebooks do Databricks usando PySpark e Spark SQL
- Desenvolvimento de pipelines de ETL e ELT em batch
- Arquitetura de lakehouse Bronze, Silver e Gold
- Tabelas Delta Lake, MERGE e cargas incrementais
- Limpeza, transformação e validação de dados
- Configuração de workflow e jobs
- Depuração e melhorias de performance
- Comentários claros no código e documentação técnica
Você receberá código fonte de fácil manutenção, lógica de pipeline bem definida e documentação prática para operar a solução.
Por favor, envie uma mensagem pelo Fiverr antes de solicitar o pacote Premium ou qualquer projeto que envolva acesso à produção, streaming, configuração de infraestrutura, dados sensíveis ou prazo urgente.
Warehouse Platform:
Snowflake
•
BigQuery
•
Databricks
Tipo de projeto:
New Build

