Vou construir pipelines de dados usando databricks, pyspark, azure e sql
Engenheiro de Dados Sênior
Sobre este Serviço
Vou construir, otimizar ou solucionar problemas em pipelines de dados usando Databricks, PySpark, Azure Data Factory, Azure Data Lake, Delta Lake e SQL.
Com mais de 5 anos de experiência em engenharia de dados corporativos, posso ajudar você a transformar dados brutos em pipelines confiáveis, escaláveis e fáceis de manter.
Meus serviços incluem:
Desenvolvimento de pipelines ETL/ELT
Desenvolvimento com Databricks & PySpark
Orquestração com Azure Data Factory
Ingestão e transformação de dados
Desenvolvimento e otimização de SQL
Soluções Delta Lake
Processamento em batch e incremental
Verificações de qualidade de dados e validações
Solução de problemas e otimização de pipelines
Migração de dados para Databricks
Testes unitários e documentação técnica
Se você precisa de um pipeline novo, quer corrigir um fluxo existente ou ajudar a modernizar uma plataforma de dados, posso trabalhar com sua arquitetura e requisitos atuais.
Foco em implementação limpa, processamento escalável com Spark, fluxos de dados confiáveis e documentação clara.
Por favor, envie uma mensagem antes de fazer seu pedido com seus requisitos, detalhes de origem/destino e entregáveis esperados, assim posso confirmar o escopo e recomendar o pacote adequado.
Ferramentas e plataformas:
Fábrica de dados do Azure
•
Outros
Perguntas frequentes
Tradução automática
1. Com quais tecnologias você trabalha?
Databricks, PySpark, Azure Data Factory, Azure Data Lake, Delta Lake, SQL e serviços de dados relacionados da Azure.
2. Você consegue construir um pipeline ETL completo?
Sim. Dependendo do pacote, posso cuidar da ingestão, transformação, orquestração, verificações de qualidade de dados, testes e documentação.
3. Você consegue corrigir um pipeline Databricks ou PySpark existente?
Sim. Posso solucionar erros, revisar códigos existentes, identificar gargalos e implementar melhorias.
4. Você consegue migrar pipelines existentes para Databricks?
Sim. Posso ajudar a migrar e modernizar cargas de trabalho de dados usando Databricks, PySpark e Delta Lake.
5. Que informações você precisa para começar?
Por favor, forneça seus requisitos, sistemas de origem e destino, dados/exemplo de esquema quando aplicável, código ou pipelines existentes e resultado esperado.
6. Você consegue lidar com requisitos personalizados?
Sim. Se seu requisito não se encaixar nos pacotes listados, entre em contato comigo primeiro para definirmos o escopo e criar uma oferta personalizada.
