产品介绍
Agent 安全中心是百度智能云专为AI Agent场景构建的全生命周期安全平台,覆盖从研发接入到应用治理的全链路防护:支持Agent资产清点、身份与权限管控、工具调用防护、Prompt注入与越狱防护、代码执行安全防护、数据安全等核心能力;通过可观测与审计对Agent行为轨迹全程刻画,结合事前测评提前识别安全盲区,以统一管控平台实现企业级Agent安全治理。让每个Agent看得见、管得住、追得到。

为什么需要 Agent 安全中心
当 AI Agent 从试点(PoC)走向生产,它不再只是“生成内容”,而是演进为能自主决策、调用工具、访问数据、执行命令的“自主执行主体”。这种高自治 + 强工具调用的组合,带来了全新风险面:不可信输入 → LLM → 下游工具/插件执行。一旦这条链路被攻击者利用,后果可能是数据外泄、越权操作乃至系统被破坏。
企业在 Agent 应用落地时,主要关注的安全风险:
- 提示词注入:攻击者将恶意指令隐藏于网页、文档、邮件等外部内容中,诱导 Agent 偏离原定任务、执行非预期操作。
- 工具调用与代码执行失控:Agent 具备调用工具、执行命令的能力,一旦被操控,可能在业务系统中执行删除、篡改等高危动作。
- Skill 供应链风险:Agent 依赖第三方 Skill 扩展能力,其来源难以验证,存在恶意代码植入与投毒风险,且安装后使用范围难以管控。
- 越权与代理权滥用:Agent 被授予的权限可能被滥用于访问敏感数据、操作关键资源;身份可信不等于行为可控。
- 凭证泄露:Agent 使用的密钥、Token 若明文存储或意外暴露,可能被冒用以执行未授权操作。
- 数据源污染:知识库、历史会话等数据被篡改后,可能在后续任务中诱发错误决策或恶意行为。
- 敏感信息外泄:Agent 在交互与结果输出过程中,可能无意间将敏感数据传递至外部。
- 运行行为失控:Agent 自主执行任务时可能偏离既定目标、难以及时中止,需具备实时监控与阻断能力。
- 审计与追溯缺失:Agent 操作若缺乏完整留痕,事后难以还原过程、界定责任,带来合规压力。
Agent 安全中心的核心能力
• 资产清点:统一清点企业内全部 AI Agent 并进行指纹梳理,同时盘点其安装的 Skill 与 MCP 资产(含 MCP 接入方式、来源、暴露工具数等),汇总每个资产的待处理安全风险,并支持“一键 Skills 体检”重新识别与评估。
• 风险运营:集中运营检测告警信息,支持按告警等级、时间、威胁类型筛选,提供分类型的告警详情与处置建议;可对告警进行响应处置。
• 专项治理:面向具体风险面的专项检查与防护——配置检查(基于安全基线与合规模板,按 Agent 架构区分检查项巡检脆弱配置并给出修复建议)。
• Skill 安全:对 Agent 可使用的 Skill 进行安全评估(生成包含威胁风险、权限风险、合规风险的评估报告)与全生命周期管控,包括黑名单、白名单(仅允许模式)、卸载保护、安装源控制、检测周期设置、完整性校验(哈希校验),并完整记录拦截日志与安装/卸载记录。
• Agent 安全护栏:对 Agent 的用户提问、工具调用前、工具调用后、Agent 输出等环节进行安全护栏审核,支持正常放行、拦截、二次确认等处置,并提供审核次数、风险比例、违规原因分布等数据统计与提问详情查询(含安全策略流程与判定详情)。
• Agent 管控:对 Agent 运行时行为进行策略化管控——命令管控(黑/白名单 + 拦截/告警,内置高危命令黑名单如 rm -rf /* 等)、敏感目录管控(管控对 /etc、密钥目录等的访问)、网络资源管控(URL/IP 黑名单、网络访问拦截日志)。
• 安全审计:对 Agent 执行过程中的工具调用、命令执行、文件读写、网络请求、模型输入输出等行为进行全量留痕。
• 系统管理:统一管理 Agent 客户端的安装以及授权管理。
使用边界
支持防护的 Agent 应用
| Agent(智能体) | 版本 | 资产采集 | 安全告警 | Skill安全(运行时防护) | Agent安全护栏 | Agent管控 | 安全审计 |
|---|---|---|---|---|---|---|---|
| OpenClaw | 4.21~7.1 | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
| OpenCode | 1.14.29~1.15.13 | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
部署形态
支持 公有云 SaaS 与 私有化部署 两种交付形态,可满足金融、能源、政务等对“数据不出内网”有强要求的行业。私有化部署请咨询客户经理。
运行环境要求
- 操作系统:安全客户端目前仅支持在 Linux 系统的 Agent 运行环境上安装。
- 权限与网络:安装需要 root/sudo 权限,且目标环境需可访问管理平台接入地址。
- 护栏前置:使用 Agent 安全护栏前需手动完成 AK/SK 配置,确保服务联通后生效。
评价此篇文章
