Realizaré jailbreak de modelos de AI, pruebas de inyección de prompts y análisis de seguridad de LLM

N
neonxploit
N
neonxploit
Manjeet

1 pedido en espera

Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

Realizaré una evaluación completa de la seguridad del modelo de AI, incluyendo pruebas de jailbreak, análisis de inyección de prompts, intentos de eludir filtros de seguridad y detección de vulnerabilidades para LLMs y chatbots.

Me especializo en identificar debilidades en sistemas de AI y en exponer cómo los atacantes pueden manipular tu modelo para generar respuestas inseguras, dañinas, sesgadas o no autorizadas.


QUÉ PROBARÉ

1. Ataques de jailbreak

  • Jailbreak estilo DAN
  • Anulación del prompt del sistema
  • Ataques de cambio de personalidad
  • Escape de roles y activación forzada del modo interno

2. Ataques de inyección de prompts

  • Manipulación directa del prompt
  • Inyección indirecta de prompts (instrucciones ocultas)
  • Inyección de prompts en HTML/Markdown
  • Ataques de envenenamiento del contexto

3. Eludir filtros de seguridad

  • Eludir las barreras de seguridad
  • Hacer que el modelo genere contenido restringido
  • Eludir límites éticos
  • Conflictos de políticas ocultos

4. Ataques adversariales de múltiples pasos

  • Manipulación de cadenas de pensamiento
  • Ataques contextuales en múltiples capas
  • Lagunas en instrucciones recursivas

5. Pruebas de alucinaciones y sesgos

  • Condiciones que provocan alucinaciones
  • Verificación de amplificación de sesgos
  • Respuestas contradictorias
  • Trampas de razonamiento incorrecto

Conoce a Manjeet

Manjeet
  • DeIndia
  • Miembro desdeabr 2025
  • Responde aprox. en:1 hora
  • Última entrega1 mes
  • Idiomas

    Inglés
I am an AI Safety Tester and Cybersecurity Researcher with expertise in identifying vulnerabilities in AI models, LLMs, and web systems. I specialize in: AI jailbreak detection Prompt injection testing LLM safety evaluation Security auditing for chatbots Penetration testing basics Python-based security automation I have submitted 36+ AI vulnerability reports and received 20+ acknowledgments from OpenAI for ethical research. If you need someone to test your AI model, secure your chatbot, or evaluate your system for vulnerabilities — I can help with professional reporting and fast

Traducción automática