Vou configurar um LLM privado local na sua própria máquina com ollama


Sobre este Serviço
Tradução automática
Seus dados permanecem no seu hardware. Essa é a ideia principal.
Eu instalo e configuro uma pilha local de IA na sua máquina ou servidor Ollama, além de uma interface web que você realmente pode usar, modelos escolhidos de acordo com a RAM e a GPU que você possui, não por um gráfico de benchmark. Sem chaves de API, sem cobrança mensal, sem prompts saindo da sua rede.
Normalmente, isso acontece com: um advogado que não consegue colar arquivos de clientes em um chat na nuvem. Uma clínica com notas de pacientes. Uma loja com suas próprias listas de preços. Qualquer um que tentou um modelo na nuvem, leu os termos e parou.
O que você recebe:
- Ollama instalado e funcionando como um serviço, para que continue ativo após reinicializações
- Open WebUI em uma janela de chat normal no seu navegador, sem precisar de terminal no dia a dia
- Modelos escolhidos e carregados de acordo com seu hardware real, com uma breve nota sobre o que cada um faz bem
- Um guia de uma página: como iniciar, como adicionar um modelo, o que fazer se parar
Funciona em Linux, Windows ou VPS. Tenho usado servidores Linux desde 1999 e mantenho meus próprios projetos hospedados, então essa é a configuração que uso comigo mesmo.
NÃO incluído: ajuste fino ou treinamento do seu próprio modelo, compra de hardware para você, RAG sobre seu arquivo de documentos, conexão com seu CRM ou site. Qualquer um desses, me avise e eu farei o necessário.
Conheça mais sobre Lamas Toma
IT Pro since 1999, Linux, Cybersecurity, Telegram Bots, n8n
- A partir deIsrael
- Membro desdemai. de 2026
- Última entrega2 meses
Idiomas
Russo, Hebraico, Inglês
Tradução automática
Meu portfólio
Outros serviços de Desenvolvimento de IA que eu ofereço
Perguntas frequentes
Tradução automática
Quais aplicativos de IA funcionam com isso?
Qualquer coisa que fale MCP — Claude Desktop, Claude Code, Cursor e outros.
Você hospeda?
Eu deployo no seu servidor ou te entrego o código para rodar. O custo de cloud/hospedagem fica por sua conta.
Você consegue conectar minha ferramenta?
Envie a documentação. Se tiver API ou banco de dados, a resposta é quase sempre sim.
Como podemos conversar?
Tudo no chat, na sua rotina. Você mantém toda a conversa como registro.
O que você precisa de mim para começar?
A documentação ou esquema do que você quer conectar, além de qual cliente MCP você usa. Geralmente, isso já é suficiente para começar.
Vai rodar no meu computador?
Me diga a RAM e se você tem uma GPU, e eu vou te dizer honestamente qual tamanho de modelo serve. 16 GB roda um modelo pequeno de boa. Sem GPU funciona, mas mais devagar.
Alguma coisa é enviada para a internet?
Só o download do modelo uma vez. Depois disso, você pode puxar o cabo de rede e ainda assim ele responde.
Qual modelo eu vou receber?
Depende do seu hardware e do idioma. Vou pegar dois ou três para você comparar, e deixar o melhor como padrão.
Você consegue fazer isso em um servidor alugado ao invés do meu laptop?
Sim. Mesma configuração, só preciso de acesso SSH ao servidor.
E se quebrar depois que você terminar?
O guia escrito cobre reiniciar e os erros mais comuns. Se algo na minha configuração quebrar, eu conserto.

