Vou otimizar soluções de dados em sql server, tsql e pyspark
Desenvolvedor SQL Sênior, Engenheiro de Dados TSQL, SSIS, SSRS, PySpark, AWS, 14 anos de experiência
Sobre este Serviço
Farei engenharia de big data usando pyspark, hive sql, hdfs e sql
Quer desbloquear o verdadeiro potencial dos seus conjuntos de dados massivos? Precisa de pipelines de dados otimizados e escaláveis que funcionem perfeitamente? Você está no lugar certo!
Como um Engenheiro de Dados experiente, especializo-me em construir arquiteturas robustas de Big Data e fluxos de ETL eficientes. Seja para limpar dados desorganizados, migrar arquiteturas ou otimizar consultas pesadas, entrego soluções prontas para produção, altamente otimizadas e personalizadas às suas necessidades de negócio.
️ Serviços que ofereço:
Otimização de Consultas SQL: Escrever consultas relacionais complexas, procedimentos armazenados, ajuste de performance e indexação de banco de dados.
Desenvolvimento PySpark: Pipelines de ETL em lote e streaming personalizados usando PySpark RDDs, DataFrames e Spark SQL.
Hive & Hive-SQL: Design de esquemas Hive otimizados, tabelas externas/gerenciadas, particionamento, bucketing e escrita de consultas Hive-SQL de alto desempenho.
HDFS & Gestão de Armazenamento: Arquitetar estruturas de armazenamento distribuído, gerenciar formatos de arquivo (Parquet, ORC, Avro) e ingestão de dados.
Pipelines de Dados de ponta a ponta: Construção de fluxos de trabalho de dados escaláveis para transformar big data bruto em dados limpos e prontos para análise
