导语:当AI Agent能调用工具以后,安全风险就不只是回答错了,而是可能执行不该执行的动作。

问题与适用场景
适合带MCP、浏览器、文件、数据库或发布权限的Agent系统。
工作原理
提示词注入会试图改变Agent目标,权限边界能降低误操作影响。
分步操作
- 外部输入
- 提示词隔离
- 工具白名单
- 敏感动作确认
- 日志审计
- 失败中止
安全、成本或常见错误
- 不要给全局写权限
- 敏感动作需要确认
- 外部文本不要直接当系统指令
总结
Agent越能干,越需要明确边界、确认和日志。
导语:当AI Agent能调用工具以后,安全风险就不只是回答错了,而是可能执行不该执行的动作。

适合带MCP、浏览器、文件、数据库或发布权限的Agent系统。
提示词注入会试图改变Agent目标,权限边界能降低误操作影响。
Agent越能干,越需要明确边界、确认和日志。
评论 0