Solicitud
Pasa el contenido y las herramientas que el agente podría usar indebidamente. Enumerar las herramientas ayuda a GLiDE a valorar cuánto daño podría causar el contenido.Esquema de la solicitud
Respuesta
Medida contrahttps://api.fastino.ai. Los valores de confianza varían ligeramente entre llamadas.
risk.score es 3, el cuarto nivel contando desde 0: “Critical: private data could leave the company”.
Esquema de la respuesta
Actúa según la respuesta
Adáptala
- Filtra todas las fuentes no confiables: páginas obtenidas, correo entrante, archivos subidos y resultados de herramientas.
- Envía el texto oculto además del visible. Los comentarios HTML, el texto alternativo y el texto blanco sobre fondo blanco son escondites habituales.
- Enumera las herramientas reales del agente en
state.agent_toolspara queriskrefleje lo que el agente podría hacer realmente. - Añade una ruta
phishingsi hay personas que leen el mismo contenido y envíala a tu equipo de seguridad.
Guía de políticas y seguridad
Diseña compuertas que fallen de forma segura ante la incertidumbre.
Referencia de la API de GLiDE
Todos los campos, límites y errores de
POST /v1/systemone.
