Vou construir pipelines rag e sistemas de backend alimentados por IA

M
mathan_teqbahn
M
mathan_teqbahn
Mathan K
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Engenheiro de Backend IA | Pipelines RAG · Integração LLM · Sistemas agenticos


Sou um Engenheiro de Software Sênior com mais de 12 anos construindo sistemas de IA em produção. Sou o único arquiteto do Teqit, uma plataforma empresarial ao vivo com pipelines RAG, inferência de LLM local e microserviços agenticos atendendo mais de 10 clientes.


O que eu construo para você:

- Pipelines RAG para ingestão de documentos, busca vetorial, geração de respostas por LLM

- Integração de API de LLM com OpenAI, Claude, Gemini ou qualquer modelo hospedado

- Inferência local de LLM com Ollama / llama.cpp (reduz custos de IA em cerca de 70%)

- Ferramentas de workflows agenticos com chamadas de ferramenta, raciocínio em múltiplas etapas, pipelines de decisão

- Backends FastAPI ou Scala via REST ou gRPC

- Roteamento híbrido com troca inteligente entre modelos locais e na nuvem


Por que me escolher?

Já fiz isso em produção de verdade, não em tutoriais. Reduzi custos de IA em 70% com inferência local, criei pipelines de avatar gerativos de vídeo e projetei agentes que raciocinam de forma independente sobre bases de conhecimento empresarial.


Tecnologias: Python · FastAPI · Ollama · API OpenAI · Akka/Scala · Docker · AWS


Me envie uma mensagem antes de fazer o pedido, assim posso revisar seu caso de uso primeiro.

Conheça mais sobre Mathan K

Mathan K

Senior AI and Backend Engineer

  • A partir deÍndia
  • Membro desdeset. de 2026
  • Responde em aprox.:1 hora
  • Idiomas

    Inglês
Senior Software Engineer with 12+ years building production AI systems, distributed backends, and cross-platform mobile apps. I'm the sole architect of Teqit — a live multi-tenant enterprise platform with RAG pipelines, on-premise LLM inference (Ollama), and agentic microservices serving 10+ enterprise clients. I build RAG pipelines, LLM integrations, agentic workflows, and FastAPI/Scala backends — cutting AI costs ~70% with local inference. I review every project personally before starting. Message me first.

Tradução automática