Protección de sistemas de IA1 / 5
¿Qué control de seguridad actúa como filtro entre las entradas del usuario y un LLM para detectar y bloquear prompts maliciosos?
CorrectoIncorrecto
Alex
Un firewall de prompts es un control de seguridad específico para IA, diseñado para filtrar e inspeccionar las entradas del usuario antes de que lleguen al modelo de lenguaje. Funciona de forma parecida a un Web Application Firewall, pero está creado a propósito para las interacciones con LLM. Los firewalls de prompts analizan los prompts entrantes en busca de patrones asociados a prompt injection, intentos de jailbreak y violaciones de políticas. Pueden bloquear o sanear las entradas maliciosas y registrar la actividad sospechosa. Algunos firewalls de prompts también inspeccionan las salidas del modelo en busca de fugas de datos sensibles o contenido dañino. Este es un control de gateway clave en el examen SecAI+, y cae dentro de la categoría de controles de seguridad del modelo, junto con los rate limits, los límites de tokens y los controles de acceso a endpoints. Consejo para el examen: los firewalls de prompts son controles de seguridad de IA del lado de la entrada — se sitúan en el gateway entre los usuarios y el modelo.
Puedes obtener respuestas a tus dudas en la app. Crea una cuenta gratis, sin tarjeta de crédito.
Pregunta 1 de 5
Crear una cuenta gratis