Vou construir data warehouse e otimizar pipelines ETL do BigQuery na Google Cloud
Sobre este Serviço
Vou montar seus pipelines de dados na Google Cloud e reduzir sua conta do BigQuery.
Sou um engenheiro de dados que gerenciou toda a stack do BigQuery em produção, atualmente como Líder/Engenheiro de Dados Sênior, onde reduzi os custos mensais do BigQuery em 96% (de 13 mil dólares para 500 dólares), enquanto o volume de consultas triplicou, redesenhando esquemas e otimizando consultas.
O que faço:
- Construo pipelines ETL para BigQuery a partir de APIs, exportações GA4/Firebase, GCS ou bancos de dados
- Unifico GA4, Firebase, Adjust, RevenueCat, Google Ads em um único modelo no BigQuery
- Reduzo custos do BigQuery com redesenho de esquema, particionamento/clusterização, otimização de consultas
- Configuro orquestrações agendadas (Airflow, Cloud Composer, Pub/Sub)
- Construo camadas de transformação com Dataform
- Automatizo fluxos de trabalho de relatórios com Python e APIs
- Configuro Interruptores de Cobrança por projeto
- Crio e otimizo data warehouse e data lakes
- Construo dashboards diretamente do warehouse
Como trabalho: você compartilha acesso de leitura ao GCP, faço auditoria de custos de pipelines/consultas, construo ou refatoro e valido, entrego documentação e uma call de transferência.
Ferramentas: GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Me envie uma mensagem primeiro se sua configuração for não padrão.
Idioma:
Inglês
Experiência técnica:
Google BigQuery
Setor:
Data analytics
Perguntas frequentes
Tradução automática
Você precisará de acesso de cobrança/admin ao meu projeto GCP?
Não, só preciso das funções IAM específicas para o trabalho em questão (por exemplo, Data Editor do BigQuery, Job User). Vou te dizer exatamente o que conceder.
Você consegue garantir uma redução de custos de um % específico?
Cada ambiente é diferente, então não prometo um número antes de auditar seus padrões de consulta e esquema — mas redução de custos costuma ser a primeira coisa que verifico.
Você trabalha com ferramentas fora do stack do Google (AWS, Snowflake, dbt)?
Minha maior expertise é GCP/BigQuery, mas estou confortável com padrões gerais de ETL/orquestração, me envie uma mensagem se seu stack for misto.
Você consegue configurar isso para rodar sem que eu toque novamente?
Sim, os pacotes Padrão e Premium incluem orquestração agendada para pipelines rodarem automaticamente.

