术语库
六层防御栈
定义
六层防御栈是 AI Agent 安全的纵向分层模型:模型层、数据层、提示词/内容层、工具/MCP 层、身份层、治理与审计层。上一层放过的问题会被下一层放大,因此防护必须逐层落实。
这个概念由模界数智提出,行业内目前没有统一定义。
传统安全的边界是平面的——一道网络边界、一个终端、一次登录。Agent 的风险是纵向叠加的:提示注入发生在输入到模型之间,数据越权发生在检索环节,工具投毒发生在 MCP 调用环节,权限放大发生在执行身份环节。
两个现实结论:没有任何一家独立厂商覆盖全栈;这些能力是互补而非替代——买了 MCP 网关不等于解决了数据层越权,也不等于给 Agent 配了身份。
六层里最薄的是身份层与行为基线;而数据层是其余五层的前提——真正决定「这一次该不该放行」的,是系统能不能在毫秒之间回答这条数据是什么、几级、属于谁。
相关术语
- 任务授权票据 —— 任务授权票据是为单次任务签发、带有效期的授权凭证,写明受谁委托、要干什么、能用哪些级别的数据、能调哪……