Vou construir pipelines de dados robustas e escaláveis usando pyspark, databricks e airflow

Algumas informações foram traduzidas automaticamente.

Índia

Eu falo Inglês

Engenheira de Dados Certificada

Engenheiro de Dados orientado a resultados, com 4,5 anos de experiência em projetar, desenvolver, testar, suportar e otimizar pipelines escaláveis de ETL/ELT usando PySpark, Databricks, SQL, Python, A...
Sobre este Serviço

Precisa de pipelines de dados escaláveis e prontos para produção? Eu construo arquiteturas de dados de alto desempenho usando Databricks, PySpark, SQL, Apache Airflow e Apache Kafka. Desde ingestão simples de arquivos até streaming em tempo real complexo, entrego soluções otimizadas e econômicas na nuvem.


O que eu ofereço:

  • ETL/ELT de ponta a ponta: Pipelines de dados seguros usando PySpark e SQL.
  • Otimização de Databricks: Configuração de Delta Lake, Delta Live Tables (DLT) e Unity Catalog.
  • Orquestração: DAGs automatizados no Apache Airflow com tratamento de erros.
  • Streaming em tempo real: Streaming de eventos com baixa latência via Apache Kafka.
  • Otimização de desempenho: Redução de custos de computação na nuvem com consultas otimizadas.


Por que me escolher?

  • Código limpo, de nível de produção e reutilizável.
  • Experiência em nuvem empresarial (AWS / Azure).
  • Documentação arquitetural gratuita incluída.



Destination Platform:

Snowflake

Databricks Lakehouse

Teradata

Ferramentas e plataformas:

Fivetran

Kafka Connect

Microsoft SSIS