Vou construir databricks delta lake lakehouse e arquitetura medallion

J
jesseantony
J
jesseantony
Jessay
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Você quer criar um data lakehouse moderno e escalável no Databricks? Eu vou projetar e implementar um Delta Lake Lakehouse pronto para produção com arquitetura Medallion (camadas Bronze, Silver, Gold).


Com mais de 4 anos de experiência na Publicis Sapient e Alcon construindo plataformas de dados empresariais, trago expertise profunda em Databricks, PySpark e Delta Lake.


O que eu vou montar para você:

  • Configuração do Delta Lake com camadas medallion Bronze/Silver/Gold otimizadas
  • Pipelines PySpark para ingestão, transformação e agregação
  • Delta Live Tables (DLT) para pipelines declarativos e com autoescalonamento
  • Unity Catalog para governança de dados detalhada e controle de acesso
  • Verificações de qualidade de dados, aplicação de esquema e transações ACID
  • Integração com ML feature store para workflows de machine learning
  • Otimização de desempenho: Z-ordering, particionamento e compactação de arquivos
  • Workflows automatizados usando Databricks Jobs e clusters
  • Documentação completa e entrega


Tecnologias: Databricks, PySpark, Delta Lake, Delta Live Tables, Unity Catalog, Azure Data Lake Storage, Apache Spark, SQL


Me envie uma mensagem para discutir suas necessidades!

Conheça mais sobre Jessay

Jessay

Senior Data Engineer: AWS, Azure, Spark, ETL Pipelines and Data Architecture

  • A partir deÍndia
  • Membro desdeabr. de 2025
  • Responde em aprox.:3 horas
  • Última entrega6 meses
  • Idiomas

    Malaiala, Inglês
Struggling with slow pipelines or messy data? I design and build scalable ETL pipelines that deliver real results. With 5+ years on AWS and Azure, I specialize in Databricks, Apache Spark, AWS Glue, and Azure Data Factory. I have built production-grade data warehouses, optimized Spark performance, and integrated Hadoop, Hive, and HBase environments. Stack: Python, PySpark, Scala, SQL, S3, Lambda, Step Functions, Azure Data Lake Gen2, Redshift, PostgreSQL. Ready to turn your raw data into clean, actionable insights.

Tradução automática

Meu portfólio

Tags relacionadas