Skip to main content
网页、电子邮件和文档中可能隐藏着针对智能体的指令,例如一条要求它把客户名单发送到某处的注释。在不受信任的内容进入智能体上下文之前,先用 GLiDE 进行筛查,并丢弃或隔离任何试图下达命令的内容。

请求

传入内容以及智能体可能被滥用的工具。列出这些工具有助于 GLiDE 判断该内容可能造成多大损害。

请求 schema

响应

基于 https://api.fastino.ai 实测。置信度值在不同调用之间会略有差异。
risk.score 为 3,即从 0 开始计数的第四个级别:“Critical: private data could leave the company”。

响应 schema

根据答案执行操作

放行内容的门槛是有意设得很高的。一次误报只损失一个页面;一次漏掉的注入则可能泄露数据。

调整示例

  • 筛查每一个不受信任的来源:抓取的网页、收到的电子邮件、上传的文件和工具结果。
  • 除可见文本外,也要发送隐藏文本。HTML 注释、alt 文本和白底白字都是常见的藏匿位置。
  • 在 state.agent_tools 中列出智能体的真实工具,使 risk 反映智能体实际能做的事情。
  • 如果人也会阅读同样的内容,请增加 phishing 路径,并将其转交给你的安全团队。
筛查可以降低注入风险,但无法消除风险。还应限制智能体的权限,并要求它在发送数据或资金之前进行确认。

政策与安全指南

设计在不确定时安全失败的关卡。

GLiDE API 参考

POST /v1/systemone 的所有字段、限制和错误。