Vou construir um chatbot de IA no telegram que responde a partir dos seus documentos, com citações


Sobre este Serviço
Tradução automática
Seu pessoal faz as mesmas perguntas sobre os mesmos documentos — uma política, um conjunto de contratos, um manual — e a resposta sempre está na página 40 de algo.
Este serviço coloca eles atrás de um bot no Telegram que responde em palavras simples e nomeia sua fonte: documento, seção, página impressa. Quando os documentos não cobrem uma pergunta, ele diz que não.
Essa recusa é o ponto: uma resposta errada e confiante sobre sua própria política é pior do que nenhuma resposta.
Os documentos são cortados nas suas fronteiras de seção, então uma citação nomeia uma seção ao invés de uma área de uma página, e toda citação é checada com o que foi recuperado — uma referência inventada é descartada, não exibida.
BÁSICO: um conjunto de documentos, respostas com citações de seção.
PADRÃO: números de páginas impressas e uma pontuação nas suas perguntas.
PRIME: implantado no seu hosting, com limites de gastos e análises.
Eu construí isso com sete publicações do NIST, 1.019 páginas, e avaliei: 18/18 respostas sem referências inventadas, 5/5 perguntas sem resposta recusadas, 11/13 perguntas respondíveis corretas. Esses são os números dessa construção, não uma promessa sobre a sua.
Conte-me quais são seus documentos e o que seu pessoal pergunta, e direi claramente se essa é a ferramenta certa.
Conheça mais sobre Ivan Popovych
Software Developer
- A partir deUcrânia
- Membro desdemai. de 2023
Idiomas
Ucraniano, Russo, Inglês
Tradução automática
Meu portfólio
Outros serviços de Desenvolvimento de Chatbot que eu ofereço
Perguntas frequentes
Tradução automática
Ele vai inventar respostas?
Essa é a falha contra a qual este sistema foi construído. Cada citação é checada com os trechos realmente recuperados, e uma referência inventada é descartada ao invés de exibida. Na minha avaliação, foram 18/18 respostas sem referências inventadas.
O que acontece quando a resposta não está nos meus documentos?
Ele diz isso claramente. Recusar é um comportamento planejado, não um acidente, e é avaliado como tudo o mais: na minha construção, todas as cinco perguntas sem resposta foram recusadas, nenhuma delas respondida de qualquer jeito.
Para onde vão meus documentos? Você mantém uma cópia?
Eles se tornam um índice que você possui e mantém. Eu não guardo cópia após a entrega. As embeddings rodam localmente na CPU, então o indexamento não envia nada para lugar algum; apenas uma pergunta e os trechos recuperados chegam ao modelo de linguagem.
Quanto custa para rodar uma vez que está no ar?
O indexamento não custa nada — roda na sua própria máquina. Responder custa tokens do modelo, e a construção tem dois limites rígidos contados no banco de dados, por pessoa por dia e por mês, então reiniciar não dá uma nova cota para ninguém.
Posso trocar os documentos depois, ou adicionar mais?
Sim. O conjunto de documentos é uma configuração, não um código: aponte para novos arquivos e reindexe. Na minha avaliação, substituir todas as sete publicações por outro conjunto é uma edição de um arquivo de configuração.
Quero um bot que aceite pedidos ou reservas, não um que responda perguntas. Você consegue fazer isso?
Sim, mas não com esse serviço — esse é meu outro, o bot no Telegram e Mini App que substitui um processo manual. É baseado em regras: menus, formulários e passos que você define. Me envie uma mensagem se não tiver certeza de qual dos dois se encaixa.

