Vou fazer o teste de equipe vermelha no seu agente LLM para injeção de prompt e ataques de memória

S
sidharth1
S
sidharth1
Sidharth P
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Seu agente LLM é seguro para ser colocado na frente de usuários reais? Eu vou atacá-lo do jeito que um adversário real faria e te direi exatamente o que quebra e como consertar.


Sou pesquisador de segurança de IA com artigos no ICML e IJCNLP e trabalhos no arXiv sobre ataques de memória contra agentes LLM. Também criei benchmarks de avaliação LLM-judge, então meus testes são sistemáticos e reproduzíveis, não apenas alguns prompts inteligentes.


O que eu testo:

  • Injeção de prompt (direta e via documentos, páginas web ou saídas de ferramentas)
  • Jailbreaks e bypass de políticas
  • Uso indevido de ferramentas e chamadas de funções
  • Contaminação de memória e contexto em agentes com memória de longo prazo
  • Vazamento de prompt do sistema e dados


O que você recebe:

Um relatório escrito claro com cada descoberta, um exemplo reproduzível, uma classificação de severidade e uma solução concreta. Pacotes mais avançados incluem a suíte de ataque como código para você reruná-la, além de um reteste após a correção.


Funciona com OpenAI, Anthropic, modelos open-source, LangChain, LlamaIndex e stacks de agentes personalizados. Me envie uma mensagem primeiro com uma descrição breve do seu agente e eu confirmarei o escopo. Testo apenas sistemas que você possui ou tem autorização para testar.

Conheça mais sobre Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • A partir deÍndia
  • Membro desdeabr. de 2017
  • Idiomas

    Telugu, Inglês, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Tradução automática

Meu portfólio

Outros serviços de Desenvolvimento de IA que eu ofereço

Tags relacionadas