请求
传入内容以及智能体可能被滥用的工具。列出这些工具有助于 GLiDE 判断该内容可能造成多大损害。请求 schema
响应
基于https://api.fastino.ai 实测。置信度值在不同调用之间会略有差异。
risk.score 为 3,即从 0 开始计数的第四个级别:“Critical: private data could leave the company”。
响应 schema
根据答案执行操作
调整示例
- 筛查每一个不受信任的来源:抓取的网页、收到的电子邮件、上传的文件和工具结果。
- 除可见文本外,也要发送隐藏文本。HTML 注释、alt 文本和白底白字都是常见的藏匿位置。
- 在
state.agent_tools中列出智能体的真实工具,使risk反映智能体实际能做的事情。 - 如果人也会阅读同样的内容,请增加
phishing路径,并将其转交给你的安全团队。
政策与安全指南
设计在不确定时安全失败的关卡。
GLiDE API 参考
POST /v1/systemone 的所有字段、限制和错误。
