Vou construir pipelines de ETL escaláveis no databricks usando pyspark sql

Algumas informações foram traduzidas automaticamente.

Índia

Eu falo Inglês

Engenheiro de Dados e Criador de Sistemas de IA, com 10 anos de experiência

Sou Arun, um Engenheiro de Dados e Consultor de IA com mais de 10 anos de experiência construindo plataformas de dados escaláveis, soluções de análise e aplicações de IA. Especializo-me em pipelines E...
Sobre este Serviço

Você precisa de um pipeline confiável no Databricks em vez de notebooks frágeis e processamento manual de dados?


Sou engenheiro de dados com 9 anos de experiência profissional construindo pipelines de ETL, plataformas de dados e soluções de análise. Trabalho com Databricks, PySpark, Spark SQL, Delta Lake, Python e serviços de dados na nuvem para transformar dados brutos em conjuntos de dados limpos e prontos para análise.

Posso ajudar você com:

  • Notebooks do Databricks usando PySpark e Spark SQL
  • Desenvolvimento de pipelines de ETL e ELT em batch
  • Arquitetura de lakehouse Bronze, Silver e Gold
  • Tabelas Delta Lake, MERGE e cargas incrementais
  • Limpeza, transformação e validação de dados
  • Configuração de workflow e jobs
  • Depuração e melhorias de performance
  • Comentários claros no código e documentação técnica


Você receberá código fonte de fácil manutenção, lógica de pipeline bem definida e documentação prática para operar a solução.


Por favor, envie uma mensagem pelo Fiverr antes de solicitar o pacote Premium ou qualquer projeto que envolva acesso à produção, streaming, configuração de infraestrutura, dados sensíveis ou prazo urgente.

Warehouse Platform:

Snowflake

BigQuery

Databricks

Tipo de projeto:

New Build

Meu portfólio