Vou configurar agentes de IA Claude code no seu VPS com Docker
Engenheiro Senior de DevOps, Segurança de Redes e Especialista em Linux
Sobre este Serviço
Tenho gerenciado frotas Linux de produção há anos. Configurar agentes de IA não é só "docker run"; é sobre fazer eles sobrevivem a reinicializações, lidarem com falhas, manterem a segurança e não explodirem sua conta de GPU.
O que você recebe:
Agente dockerizado Claude Code, OpenHands, AutoGen ou seu agente personalizado em Python/TypeScript, build multi-stage, sem root, verificações de saúde
Serviço systemd Inicia na inicialização, reinicia em caso de falha, limites de recursos (CPU/RAM/GPU), rotação de logs via journald
Proxy reverso Nginx TLS (Let's Encrypt auto-renovável), suporte a WebSocket para streaming, limitação de taxa, opção de autenticação básica
Fila Redis Fila de tarefas com prioridade, retries/exponential backoff, tratamento de dead-letter (Standard/Premium)
Observabilidade Loki + Promtail para logs, métricas Prometheus (profundidade da fila, latência, uso de tokens), painel Grafana
Vector DB Qdrant/Weaviate para agentes RAG, volume persistente, backup cron (Premium)
Guardião de custos Alerta de gastos diários (Discord/Slack/Email), desligamento automático ao ultrapassar o orçamento (Premium)
Runbook Arquitetura, guia de escalonamento, solução de problemas "agente travado?", procedimento de rotação de credenciais
Pilha que uso diariamente: Docker, Nginx, systemd, Redis, Loki/Prometheus/Grafana, Qdrant, NVIDIA Container Toolkit, APIs RunPod/Vast.ai/Lambda, Linux
Meu portfólio
Outros serviços de Engenharia de DevOps que eu ofereço
Perguntas frequentes
Tradução automática
Quais agentes você suporta?
Claude Code, OpenHands, AutoGen, CrewAI, LangGraph, agentes personalizados em Python/Node. Qualquer agente containerizável funciona. Me envie sua repo — confirmarei a compatibilidade.
Como você lida com chaves de API / segredos?
Nunca na imagem ou compose. Opções: 1) HashiCorp Vault, 2) CLI 1Password, 3) arquivos criptografados com SOPS/age, 4) segredos Docker (swarm), 5) Ambientes GitHub (CI/CD). Vamos escolher o que melhor se encaixa no seu fluxo.
Você consegue otimizar custos de GPU?
Somente Premium: alertas de gastos diários (Slack/Discord/Email), desligamento automático de agentes ociosos, fallback para spot instance (RunPod/Vast.ai), rastreamento de uso de tokens por agente. Economias típicas: 40-60% em relação ao sempre ligado.

