Vou construir pipelines de dados com pyspark e databricks

Algumas informações foram traduzidas automaticamente.

Índia

Eu falo Hindi, Inglês, Francês, Espanhol

Engenheiro de dados empresarial criando pipelines automatizados e otimizando SQL

Engenheiro de Dados | Python | SQL | ETL | Spark Eu crio pipelines de dados prontos para produção, fluxos de ETL e soluções de dados usando Python, SQL, PySpark, Apache Spark, Airflow, Databricks, Sno...
Sobre este Serviço

Precisa de ajuda para processar grandes conjuntos de dados com PySpark ou Databricks?


Vou criar pipelines de dados escaláveis usando PySpark, Apache Spark e Databricks para transformação, processamento e análise de dados.


Posso ajudar com:

  • Transformações e limpeza de dados com PySpark
  • Notebooks e fluxos de trabalho no Databricks
  • Desenvolvimento de pipelines ETL/ELT
  • Processamento de dados em grande escala
  • Joins, agregações, filtros e deduplicação
  • Processamento incremental e em batch
  • Validação de dados e verificações de qualidade
  • Otimização de performance
  • Carregar dados em data warehouses e bancos de dados

Foco em pipelines limpos, fáceis de manter e eficientes, com documentação clara.


Entre em contato comigo antes de fazer o pedido para projetos complexos, assim posso entender seus dados e requisitos.

Warehouse Platform:

Snowflake

•

Azure Synapse

•

Databricks

Tipo de projeto:

New Build

Meu portfólio

Outros serviços de Engenharia de Dados que eu ofereço