人工智能进阶文档深度页
Agent 安全边界
用最小权限、信任分层、审批和结果校验限制 Agent 的可行动范围。
学习目标
- 能说明Agent 安全边界解决什么问题,以及何时适用。
- 能解释为什么“默认开放全部工具”是误区。
学习前需要掌握
背景与问题
Agent 会把自然语言连接到真实动作,因此提示注入、越权和副作用风险高于纯文本问答。
概念定义
安全边界决定什么输入可信、哪些工具可见、谁能批准、哪些数据可读写以及失败时如何隔离。
直观理解
即使负责人很聪明,也只能拿到当前工作需要的钥匙;开保险柜仍需第二个人确认。
核心原理
提示中的禁止语不能替代真正的权限检查。
读取与写入工具应分离,敏感动作默认审批。
外部内容永远不应自动获得指令权限。
理解与实践步骤
- 1
画出信任边界
- 2
按任务过滤工具
- 3
执行前校验身份与范围
- 4
敏感动作审批
- 5
结果验证和审计
实际应用
- 企业 Agent
- 本地文件助手
常见错误
默认开放全部工具
日志记录敏感正文
输入、输出与执行边界
输入
- 身份
- 任务范围
- 工具权限
输出
- 允许、拒绝或待审批
能力
- 企业 Agent
- 本地文件助手
只读优先默认不要求审批
推荐学习资料
暂未收录相关资料
参考库不会生成虚假资源或无效外部链接。