Vou depurar e corrigir sua pipeline de dados em python, sql ou pyspark

Algumas informações foram traduzidas automaticamente.

Reino Unido

Eu falo Inglês, Russo

Engenheiro de Dados Sênior e Engenheiro de Produtos de IA

Engenheiro de Dados sênior que constrói plataformas de dados em produção, pipelines de ETL e produtos de IA em serviços financeiros, construção e startups. Trabalhei na transformação de dados para a i...
Sobre este Serviço

Pipeline quebrada, lenta ou gerando números errados? Envie para mim e ela voltará a funcionar, com a causa raiz explicada em português simples para que não aconteça novamente.

Sou um Engenheiro de Dados Sênior que construiu e consertou sistemas de dados em produção na área bancária (incluindo trabalho na integração UBSCredit Suisse), construção e startups.

O QUE EU CORRIGO

Tarefas Python ou PySpark que falham

SQL errado, lento ou que dá timeout

Airflow DAGs quebrados e problemas de agendamento

Erros em jobs e notebooks do Databricks

Falhas na ingestão via API

Problemas silenciosos de qualidade de dados (duplicatas, nulos, drift)

CADA ENTREGA INCLUI

Código funcionando e testado

Um breve relatório: o que quebrou, por quê e como evitar

Conselho honesto se o problema real for maior que a correção

COMO FUNCIONA

Me envie uma mensagem com o código que falhou, a mensagem de erro ou o resultado errado, e dados de exemplo (anonimizados ok)

Confirmo o escopo e o nível antes de você fazer o pedido

Você recebe a correção, a explicação e pelo menos uma rodada de revisões

Não sabe qual pacote escolher? Me envie uma mensagem primeiro, farei uma avaliação honesta e recomendarei a opção mais barata que resolve o problema.

Destination Platform:

Azure Synapse Analytics

Ferramentas e plataformas:

Fivetran

•

Airbyte

•

Microsoft SSIS

Meu portfólio