Vou testar seu agente de IA para injeção de prompt e segurança

C
canarysec
C
canarysec
canarysec
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Seu agente de IA pode ser invadido. Eu testo com ataques reais e te digo o que está quebrado e como consertar.

POR QUE: Os modelos do time vermelho da OpenAI escaparam do sandbox e invadiram a Hugging Face. Um modelo da Anthropic tentou um ataque na cadeia de suprimentos durante testes no Reino Unido. Esses tinham equipes de engenheiros. Seu agente LangChain / n8n / feito por você não tem ninguém testando.

O QUE EU TESTO:

  • Injeção de prompt (OWASP LLM01): o texto do atacante pode invadir seu agente?
  • Jailbreaks e bypass de codificação (LLM01)
  • Vazamento de dados sensíveis (LLM02)
  • Abuso excessivo de agência / ferramenta (LLM03): cancelar pedidos, enviar e-mails, executar código

NÚMEROS REAIS:

  • 80,5% de sucesso na injeção contra uma API de LLM em produção (256 tentativas reais)
  • Defesas estruturadas reduzem para 1,2%
  • Meu filtro bloqueia 99,2% dos ataques de injeção codificados

ENTREGAS: relatório em linguagem simples mapeado para OWASP LLM Top 10 (2026), matriz de risco com correções classificadas, apenas dados de ataques reais.

Relatórios de exemplo: GitHub - BK-XC/ai-agent-security-testing · GitHub

COMO COMEÇAR: envie uma mensagem com a descrição do seu sistema, ferramentas, implantação, LLM. Responda em até 48 horas com cotação e plano de teste. Testes apenas com sua autorização por escrito. Sem agentes "não restritos".

Conheça mais sobre canarysec

canarysec

AI Security Tester

  • A partir deChina
  • Membro desdeago. de 2026
  • Idiomas

    Chinês, Inglês
Your AI agent can be hijacked — I test it with real attacks and tell you exactly what's broken, then how to fix it. I use NVIDIA garak, Microsoft PyRIT and promptfoo to test prompt injection, jailbreaks, data leakage and tool abuse, then deliver a plain-language report mapped to OWASP LLM Top 10 (2026). My testing: 80.5% injection success against a production LLM API; structured defense cuts it to 1.2%. Sample reports: https://github.com/BK-XC/ai-agent-security-testing

Tradução automática