Vou construir pipelines ETL em python para seu data warehouse
Estagiário de Engenharia de Produto
Sobre este Serviço
Sou estudante de Engenharia de Ciência da Computação com experiência prática na construção de pipelines ETL e soluções de engenharia de dados usando Python, SQL e Databricks. Através de estágios reais, criei serviços de backend e APIs REST que processam grandes volumes de dados (mais de 120 milhões de registros), integrei Databricks, Unity Catalog e Delta Tables em fluxos de trabalho de produção, e implementei pipelines de validação e limpeza de dados para equipes de engenharia.
O que eu ofereço:
Design e desenvolvimento de pipelines ETL (extrair, transformar, carregar)
Conexão com fontes de dados (bancos de dados, APIs, arquivos)
Limpeza, formatação e validação de dados
Fluxos de trabalho com Databricks e Delta Table
Integração de APIs para fluxos de dados automatizados
Código limpo, documentado e reutilizável
Foco em criar pipelines confiáveis, bem estruturados e fáceis de manter, não apenas scripts rápidos.
Comunico-me claramente durante todo o projeto e entrego no prazo.
Tecnologia:
apache spark
•
JAVA
•
Python
•
R
•
SQL
•
Databricks
Meu portfólio
Perguntas frequentes
Tradução automática
Você trabalha com data warehouses além do Databricks?
Databricks é minha principal expertise. Para outras plataformas, envie uma mensagem primeiro para eu confirmar se encaixa. Mas posso trabalhar, se eu me sentir confortável com ela.
Vou receber o código-fonte?
Sim, incluso no pacote Premium (ou como complemento).
Você consegue lidar com múltiplas fontes de dados?
Sim — os pacotes Padrão e Premium suportam múltiplas fontes.
Quais informações você precisa para começar?
Sua(s) fonte(s) de dados, destino/warehouse, e qualquer lógica de transformação específica.
