Vou construir pipelines de dados ETL na AWS usando AWS glue, pyspark, s3 e redshift

Algumas informações foram traduzidas automaticamente.

Índia

Eu falo Inglês

Engenheiro de Dados na AWS, ETL, PySpark, AWS Glue, Airflow

Engenheiro de Dados na AWS com mais de 5 anos de experiência construindo pipelines de ETL escaláveis, lagos de dados e soluções de dados na nuvem. Hábil em AWS Glue, PySpark, Python, SQL, Airflow, S3,...
Sobre este Serviço

Use todo o espaço de 1200 caracteres para tornar a palavra-chave do Gig rica em palavras, mas ainda assim legível:

Vou criar pipelines de dados ETL confiáveis e escaláveis na AWS usando AWS Glue, PySpark, Python, Amazon S3, Amazon Redshift e outros serviços da AWS.

Posso ajudar você a desenvolver novos pipelines de dados, automatizar o processamento de dados, transformar conjuntos de dados ou solucionar problemas em fluxos de ETL existentes.

Meus serviços incluem:

Desenvolvimento de jobs ETL com AWS Glue

Transformações de dados com PySpark e Python

Ingestão e processamento de dados no S3

Processamento de dados em CSV, JSON e Parquet

Carregamento e transformação de dados no Redshift

Soluções Athena e Apache Iceberg

Validação e reconciliação de dados

Tratamento de erros e registro de pipelines

Otimização de desempenho de ETL

Migração de dados e automação

Foco em soluções limpas, fáceis de manter e prontas para produção, com validação adequada, tratamento de erros e documentação.

Se precisar de uma tarefa pequena de ETL ou de um pipeline completo de dados na AWS, posso desenvolver uma solução de acordo com suas necessidades.

Por favor, entre em contato antes de fazer o pedido para requisitos complexos ou multi-serviços, assim posso entender seu escopo e recomendar o pacote adequado.

Especialidade:

Big data

•

Extração de dados

•

Manipulação de dados

Tecnologia:

Amazon Redshift

•

Excel

•

Python

•

SQL

•

NoSQL

•

Apache Airflow

Meu portfólio