更新时间:2026-09-04 GMT+08:00
分享

配置Agent行为轨迹检测策略

随着智能体(Agent)在企业核心业务场景中的深入应用,其行为安全与可控性成为关键挑战。智能体在执行复杂任务时,可能出现意图偏离、越权操作、数据泄露等风险行为,给企业带来难以预估的损失。

智能体卫士基于全链路Trace可观测日志,构建多维度行为检测策略,支持防护的维度如表1所示。

表1 防护维度说明

防护维度

说明

相关操作

意图行为一致性检测

基于大模型,深度解析用户原始意图与调用链上下文,动态校验智能体工作流与用户意图的一致性,精准检测提示词注入、数据投毒、越狱、越权操作等攻击。

开启意图行为一致性检测

命令执行检测

内置高危操作语义识别引擎,实时检测rm -rf等高危系统命令,避免提示词注入导致的核心数据丢失。

配置命令执行检测策略

文件访问检测

精准识别系统目录、配置文件及敏感路径访问,严格管控Agent文件访问权限,防止跨目录越权读取和非法篡改。

配置文件访问检测策略

敏感信息检测

内置敏感信息识别引擎,覆盖个人隐私信息、认证凭证等多个维度,严防Agent交互过程中敏感信息被诱导泄露。

配置敏感信息检测策略

约束限制

该策略只适用于OfficeAce、AgentArts智能体。

相关文档

  • 停用策略:单击目标策略的开关按钮,在弹窗中输入“YES”二次确认,单击“确定”表示策略已停用。
  • 启用策略:单击目标策略的开关按钮,在弹窗中输入“YES”二次确认,单击“确定”表示策略已启用。

相关文档