Vou construir pipelines de ETL, ELT com python, spark, airflow e dbt

Algumas informações foram traduzidas automaticamente.

Paquistão

Eu falo Inglês

Engenheiro de Dados e IA, Python, PySpark, Airflow e Cloud ETL

Precisa de dados confiáveis, mas está com pipelines quebrados? Ajudo empresas a construir fluxos de ETL/ELT robustos que realmente funcionam. Sou Engenheiro de Dados especializado em infraestrutura de...
Sobre este Serviço

Sobre este serviço:

Precisa que seus dados sejam limpos, transformados e fluam de forma confiável do fonte até o destino? Eu construo pipelines ETL/ELT usando ferramentas modernas de engenharia de dados como Python, PySpark, SQL, Apache Airflow, dbt e Databricks, seguindo a arquitetura Medallion (Bronze/Silver/Gold) para camadas de dados limpas e em estilo de produção.

Trabalhos recentes incluem um pipeline que ingere dados ao vivo via API, orquestra tudo pelo Airflow com alertas automáticos de falhas, transforma usando mais de 10 modelos dbt com mais de 60 testes de qualidade de dados, e exibe os resultados em um dashboard Power BI além de um pipeline separado no Databricks que processa dados de e-commerce de ponta a ponta com PySpark.

O que eu ofereço:

  • Design e desenvolvimento de pipelines ETL/ELT (batch)
  • Limpeza, validação e testes de qualidade de dados
  • Implementação da arquitetura Medallion (Bronze/Silver/Gold)
  • Orquestração com Apache Airflow
  • Transformação de dados com dbt, SQL, PySpark
  • Desenvolvimento de pipelines no Databricks
  • Ingestão de dados via API
  • Integração de dashboards (Power BI)

Por que trabalhar comigo:

  • Projetos reais e verificáveis, cada entrega é apoiada por um repositório público no GitHub
  • Comunicação clara, prazos realistas
  • Código limpo, documentado, em estilo de produção, não scripts descartáveis

Destination Platform:

PostgreSQL

•

Amazon S3

•

Outros

Ferramentas e plataformas:

Fábrica de dados do Azure

•

Outros

Meu portfólio