47

Agent安全面临哪些新挑战?如何设计安全可控的Agent?

Agent开发与工具调用困难

📋 面试问题

Agent安全面临哪些新挑战?如何设计安全可控的Agent?

✅ 期望回答

Agent特有的安全风险:
  • 权限扩大:Agent有工具调用能力,风险远超纯文本LLM(可能删除文件、发送邮件、转账)
  • 间接Prompt注入:用户上传文件内容包含恶意指令,Agent读取后执行
  • 过度信任模型决策:对LLM的决策不加验证直接执行
  • 连锁效应:一个错误工具调用引发连锁错误

安全设计原则:
  • 最小权限原则:Agent只获得完成任务所需的最小工具权限,每个工具调用设置白名单
  • 人工确认:高风险操作(删除、发送、发布、扣费) -> 需要人工审批
  • 沙箱隔离:Agent执行环境与生产环境隔离,无法直接操作真实数据
  • 操作审计:所有工具调用完整记录(时间、参数、结果),可追溯审计
  • 调用预算:每个Agent每天可调用工具的次数/金额上限,防止无限消耗
  • 输入过滤+输出验证:对Agent拿到的数据和生成的指令做安全审查
#安全#权限控制#审计