Evaluaré la seguridad de tu agente LLM para inyección de prompts y ataques de memoria

S
sidharth1
S
sidharth1
Sidharth P
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

¿Es seguro poner tu agente LLM frente a usuarios reales? Lo atacaré como lo haría un adversario real y te diré exactamente qué falla y cómo arreglarlo.


Soy investigador en seguridad de IA con publicaciones en ICML y IJCNLP, y trabajo en arXiv sobre ataques de memoria contra agentes LLM. También he creado benchmarks de evaluación LLM-judge, por lo que mis pruebas son sistemáticas y reproducibles, no solo unos prompts ingeniosos.


Lo que pruebo:

  • Inyección de prompts (directa y vía documentos, páginas web o salidas de herramientas)
  • Jailbreaks y evasión de políticas
  • Mal uso de herramientas y llamadas a funciones
  • Envenenamiento de memoria y contexto en agentes con memoria a largo plazo
  • Filtración de sistema y datos


Lo que obtienes:

Un informe escrito claro con cada hallazgo, un ejemplo reproducible, una calificación de severidad y una solución concreta. Los paquetes superiores incluyen la suite de ataques como código para que puedas volver a ejecutarla, además de una nueva prueba después de aplicar las correcciones.


Funciona con OpenAI, Anthropic, modelos de código abierto, LangChain, LlamaIndex y stacks de agentes personalizados. Envíame un mensaje primero con una breve descripción de tu agente y confirmaré el alcance. Solo pruebo sistemas que posees o para los que tienes autorización.

Conoce a Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • DeIndia
  • Miembro desdeabr 2017
  • Idiomas

    Telugu, Inglés, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Traducción automática

Mi porfolio

Otros servicios de Desarrollo de IA que ofrezco

Etiquetas relacionadas