Zero-Trust(AI Agent 框架)
? 概念页:把”从不信任、始终验证”的零信任原则应用到 AI Agent 的安全框架。本页为 stub。
核心定义
Zero-Trust for AI Agents 把经典零信任安全原则(never trust, always verify;最小权限;持续校验;全链审计)迁移到 AI Agent 场景:对 Agent 的每一次工具调用、数据访问、外部动作都假定不可信,必须经过显式授权与校验,并保留可审计轨迹。代表论述为 Anthropic 安全白皮书(Anthropic Zero Trust 白皮书)。
关联
- Anthropic — 白皮书来源
- AI-Agent-Security — 上位安全主题(如存在)
? 建议补强:Zero-Trust 在 Agent 中的具体实现(权限引擎、沙箱、HITL),与”能力与安全非单调”论的交叉。