Vou auditar seu agente de IA para injeção de prompt e riscos de segurança


Level 1
Sobre este Serviço
Tradução automática
Seu agente de IA é seguro para ser colocado na frente de usuários reais? A maioria dos agentes de IA vem sem testes de injeção de prompt, o que significa que qualquer um pode enganar seu chatbot para ignorar suas instruções, vazar seu prompt do sistema ou executar ações que não deveria.
Eu realizo uma auditoria completa de segurança de agentes de IA: tentativas de injeção de prompt, testes de jailbreak, verificações de vazamento de dados e cenários de abuso de chamadas de API/ferramentas, usando as mesmas técnicas que um usuário malicioso tentaria, mas documentadas para que você possa corrigir antes que sejam exploradas.
O que está incluso:
- Auditoria de segurança de LLM: vazamento de prompt do sistema, sobrescrição de instruções, resistência a jailbreak
- Testes de injeção de prompt: injeção direta e indireta via entrada do usuário, documentos ou saídas de ferramenta
- Red teaming de IA: testes adversariais contra chamadas de ferramenta e permissões reais do seu agente
- Testes de vulnerabilidade: chaves de API, acesso inseguro a ferramentas e permissões excessivas do agente
- Relatório escrito classificando os achados por gravidade, com recomendações de correção
Sobre minha experiência: mais de 2 anos em backend Python, engenharia de LLM/GenAI, pipelines RAG e automação de IA em mais de 30 projetos freelance.
Me envie acesso ao seu agente (ou uma versão sandbox/demonstração) e farei o escopo da auditoria antes de começar.
Conheça mais sobre Anchal
AI ML Developer: NLP Generative AI RAG and Automation Expert
Level 1
- A partir deÍndia
- Membro desdejul. de 2024
- Responde em aprox.:1 hora
- Última entrega2 semanas
Idiomas
Hindi, Inglês
Tradução automática
Meu portfólio
Outros serviços de Desenvolvimento de Software que eu ofereço
Perguntas frequentes
Tradução automática
Você precisa de acesso completo ao meu sistema ou posso fornecer uma versão sandbox?
Uma versão sandbox ou de demonstração está ótimo — não preciso de acesso à produção nem dos seus dados reais de usuário para realizar a auditoria.
Você realmente vai tentar quebrar meu agente ou só revisar o código?
Ambos. Eu testo como um atacante faria (tentativas ao vivo de injeção de prompt) e reviso a configuração de prompt/permissões, já que vulnerabilidades reais geralmente estão em ambos os lugares.
E se você encontrar um problema crítico — você também corrige?
Cobertura básica e padrão incluem apenas a auditoria e o relatório. O pacote premium inclui a implementação de guardrails para corrigir o que for encontrado. Se algo crítico aparecer no básico/padrão, vou sinalizar imediatamente, sem esperar a entrega.
