Eu vou implantar comfyui como uma API serverless escalável no runpod

A
avivk5498
A
avivk5498
Aviv K.
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Seu fluxo de trabalho ComfyUI funciona localmente. Agora você precisa que ele funcione como um produto.

Vou implantar seu fluxo de trabalho de imagem ou vídeo existente no Runpod como uma API de produção que seu aplicativo pode chamar.


Isso é mais do que uma configuração básica de pod. Eu construo o backend ao redor necessário para rodar inferência de GPU de forma confiável, segura e em escala.


Dependendo do seu pacote, o sistema pode incluir:

  • Implantação do ComfyUI em Docker
  • API autenticada com entradas de fluxo de trabalho dinâmicas
  • Execução em fila e autoscaling de trabalhadores GPU
  • Armazenamento privado de saída e webhooks
  • Retries, timeouts, logs e monitoramento
  • Otimização de cold-start, VRAM e custos de GPU
  • Código fonte, documentação da API e entrega técnica


Trabalho com fluxos de trabalho Wan, LTX, MiniMax, Qwen, Z-Image, Krea, Flux e Stable Diffusion.

Um backend do Runpod que construí processou mais de 45.000 jobs com 99,9% de uptime, enquanto reduzia os custos de GPU em aproximadamente 60%.

Antes de fazer o pedido, envie o JSON do seu fluxo de trabalho, modelos necessários, tráfego esperado e entradas da API. Confirmarei o pacote adequado e identificarei quaisquer mudanças no fluxo de trabalho necessárias antes da implantação.

Conheça mais sobre Aviv K.

Aviv K.

Senior AI Engineer, Runpod and ComfyUI, Solutions Architect

  • A partir deIsrael
  • Membro desdeago. de 2026
  • Idiomas

    Inglês, Hebraico
I'm a senior software engineer and solutions architect who turns AI ideas into systems teams can run. I design and build governed AI agents, AWS serverless workflows, Runpod and ComfyUI backends, image and video APIs, and LoRA training pipelines. Before specializing in AI, I handled more than 250 production incidents. One generation backend I built processed 45,000+ jobs at 99.9% uptime while reducing GPU costs by about 60%. I work from diagnosis and architecture through deployment, monitoring, and handoff. If you need technical direction and an engineer who can build the system, let's talk.

Tradução automática

Meu portfólio