Vou construir pipelines de ETL e soluções de engenharia de dados no Databricks

Algumas informações foram traduzidas automaticamente.

Índia

Eu falo Inglês, Hindi

Engenheiro de dados

Sou um Engenheiro de Dados com mais de 3 anos de experiência em projetar e otimizar pipelines de ETL e implementar soluções nativas na nuvem no Azure. Especializado em Python, SQL e Spark, com experti...
Sobre este Serviço


Engenheiro de Dados com mais de 3 anos de experiência prática na construção de pipelines de produção no Azure.


Sou especializado em projetar e implementar fluxos de trabalho de dados escaláveis usando Azure Data Factory, Databricks, PySpark e Delta Lake, desde a ingestão bruta até modelos de dados na camada Gold prontos para análise.


O que posso criar para você:

Pipelines de ETL/ELT orientados por metadata no Azure Data Factory

Arquitetura Medallion (Bronze, Silver, Gold) no Databricks

Pipelines de streaming em tempo real usando Azure Event Hubs (compatível com Kafka)

Design de data warehouse em estrela / dados dimensionais

SCD Tipo 1 e Tipo 2 para rastreamento de mudanças com autoCDC do Databricks

Transformações complexas em SQL, PySpark e procedimentos armazenados

Integrações com API REST/SOAP usando Postman para testes

Configuração do Unity Catalog e governança de dados


Pilha de tecnologia:

Python · PySpark · SQL · Azure Data Factory · Azure Databricks · Azure Data Lake Gen2 · Delta Lake · Unity Catalog · Event Hubs · Power BI


Destaques anteriores:

Publicação de pipelines na camada de publicação na Oracle

Melhoria na eficiência da API em 50% via processamento direto no backend

Redução do tempo de execução do Spark em 30% através de otimização de partições

Construção de uma plataforma de análise em tempo real para transporte por aplicativo na Azure

Idioma:

Inglês

Hindi

Experiência técnica:

Apache Airflow

apache spark

Databricks

Especialidade:

Pipelines de dados

Desenvolvimento de ETL

Setor:

Data analytics