Eu vou construir ou otimizar pipelines de dados pyspark databricks

Algumas informações foram traduzidas automaticamente.

Estados Unidos

Eu falo Inglês, Hindi

Design de Sistemas Agênticos IA FullStack e Automação, MLOps

Engenheiro de IA/ML Full-Stack e Estatístico Aplicado com 10 anos de experiência em dados, ML e IA empresarial. Crio workflows agênticos, sistemas RAG, modelos preditivos, pipelines de dados, APIs e f...
Sobre este Serviço

Precisa de um pipeline PySpark ou Databricks que seja confiável, escalável e fácil de entender?


Vou revisar, construir, corrigir ou otimizar um pipeline de dados limitado usando PySpark, Spark SQL, Delta Lake e Azure Databricks quando for adequado.


Posso resolver problemas de jobs lentos, shuffle excessivos, skew em joins, particionamento, pruning, funções de janela, recursos temporais, processamento incremental, Delta Lake, verificações de qualidade de dados e refatoração de UDFs em Python.


Sua entrega pode incluir código corrigido, resultados de desempenho, implementação do pipeline, verificações de validação, orientações de benchmark, documentação e transferência técnica.


Meu trabalho recente inclui processamento distribuído de bilhões de registros de rede de pacotes no Azure Databricks sem UDFs em Python. Foco em melhorias explicáveis e fáceis de manter.


Os pacotes cobrem jobs definidos, fontes e transformações. Custos de nuvem, credenciais de produção, administração da plataforma e dashboards não relacionados são excluídos, a menos que incluídos em uma oferta personalizada.


Por favor, envie uma mensagem antes de fazer o pedido com o código, esquemas, escala de dados, runtime atual e resultado desejado.

Idioma:

Inglês

Hindi

Experiência técnica:

apache spark

Databricks

Snowflake

Especialidade:

Pipelines de dados

Desenvolvimento de ETL

Setor:

Data analytics

Jurídico

Marketing e publicidade

Meu portfólio