Probaré tu agente de IA para inyección de prompt y seguridad

C
canarysec
C
canarysec
canarysec
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

Tu agente de IA puede ser secuestrado. Lo pruebo con ataques reales y te digo qué está roto y cómo arreglarlo.

POR QUÉ: Los modelos del equipo rojo de OpenAI escaparon de su sandbox y vulneraron Hugging Face. Un modelo de Anthropic intentó un ataque en la cadena de suministro durante las pruebas en Reino Unido. Esos tenían equipos de ingenieros. Tu agente de LangChain / n8n / construido por ti no tiene a nadie probándolo.

LO QUE PRUEBO:

  • Inyección de prompt (OWASP LLM01): ¿puede un atacante secuestrar tu agente con texto?
  • Jailbreaks y bypass de codificación (LLM01)
  • Filtración de datos sensibles (LLM02)
  • Abuso excesivo de la agencia / herramientas (LLM03): cancelar órdenes, enviar correos, ejecutar código

NÚMEROS REALES:

  • 80.5% de éxito en inyección contra una API de LLM en producción (256 intentos reales)
  • La defensa estructurada lo reduce a 1.2%
  • Mi filtro bloquea el 99.2% de ataques de inyección codificados

ENTREGABLES: informe en lenguaje sencillo mapeado a OWASP LLM Top 10 (2026), matriz de riesgos con soluciones clasificadas, solo datos de ataques reales.

Informes de muestra: GitHub - BK-XC/ai-agent-security-testing · GitHub

CÓMO EMPEZAR: envíame la descripción de tu sistema, herramientas, despliegue, LLM. Responde en 48 horas con presupuesto y plan de prueba. Solo con tu autorización escrita. No agentes "sin restricciones".

Conoce a canarysec

canarysec

AI Security Tester

  • DeChina
  • Miembro desdeago 2026
  • Idiomas

    Chino, Inglés
Your AI agent can be hijacked — I test it with real attacks and tell you exactly what's broken, then how to fix it. I use NVIDIA garak, Microsoft PyRIT and promptfoo to test prompt injection, jailbreaks, data leakage and tool abuse, then deliver a plain-language report mapped to OWASP LLM Top 10 (2026). My testing: 80.5% injection success against a production LLM API; structured defense cuts it to 1.2%. Sample reports: https://github.com/BK-XC/ai-agent-security-testing

Traducción automática