Auditaré tu agente de IA para inyección de prompt y riesgos de seguridad


Level 1
Acerca de este Servicio
Traducción automática
¿Es seguro poner tu agente de IA frente a usuarios reales? La mayoría de los agentes de IA se envían sin pruebas de inyección de prompt, lo que significa que cualquiera puede engañar a tu chatbot para que ignore sus instrucciones, filtre tu prompt del sistema o realice acciones que no debería.
Realizo una auditoría completa de seguridad de agentes de IA: intentos de inyección de prompt, pruebas de jailbreak, verificaciones de fuga de datos y escenarios de abuso de llamadas a API/herramientas, usando las mismas técnicas que un usuario malicioso intentaría, pero documentadas para que puedas corregirlas antes de que sean explotadas.
Lo que cubre:
- Auditoría de seguridad de LLM: fuga de prompt del sistema, sobrescritura de instrucciones, resistencia a jailbreak
- Pruebas de inyección de prompt: inyección directa e indirecta a través de entrada del usuario, documentos o salidas de herramientas
- Red teaming de IA: pruebas adversariales contra las llamadas a herramientas y permisos reales de tu agente
- Pruebas de vulnerabilidad para claves API, acceso inseguro a herramientas y permisos excesivos del agente
- Un informe escrito que clasifica los hallazgos por gravedad, con recomendaciones para solucionarlos
Experiencia: más de 2 años en backend con Python y en ingeniería de LLM/GenAI, pipelines RAG y automatización de IA en más de 30 proyectos freelance.
Envíame acceso a tu agente (o una versión sandbox/demostración) y definiré el alcance de la auditoría antes de comenzar.
Conoce a Anchal
AI ML Developer: NLP Generative AI RAG and Automation Expert
Level 1
- DeIndia
- Miembro desdejul 2024
- Responde aprox. en:1 hora
- Última entrega2 semanas
Idiomas
Hindi, Inglés
Traducción automática
Mi porfolio
Otros servicios de Desarrollo de software que ofrezco
FAQ
Traducción automática
¿Necesitas acceso completo a mi sistema o puedo darte una versión sandbox?
Una versión sandbox o de demostración está bien — no necesito acceso a producción ni tus datos reales de usuario para realizar la auditoría.
¿Realmente intentarás romper mi agente o solo revisarás el código?
Ambas cosas. Lo pruebo como lo haría un atacante (intentos en vivo de inyección de prompt) y reviso la configuración de prompt/permisos, ya que las vulnerabilidades reales suelen estar en ambos lugares.
¿Qué pasa si encuentras un problema crítico, también lo arreglas?
Los paquetes Basic y Standard cubren solo la auditoría y el informe. El paquete Premium incluye la implementación de guardrails para solucionar lo que se encuentre. Si surge algo crítico en Basic/Standard, lo señalaré de inmediato en lugar de esperar la entrega.
