Agent Guard 安全

AI Agent 安全架构

Agent Guard 结合明确网站授权、Intent Contract、策略评估、审批闸门、风险预算、最小化审计记录和覆盖状态报告,但不声称可以介入所有浏览器或服务器通道。

按 Origin 授权

只有用户授权某个 Origin 后才请求 Host Access;授权和可选权限均可撤销。

意图与策略

把支持的动作与网站、目的地、数据类别、动作类型、有效期、预算和新鲜用户在场要求进行比较。

审批闸门

对可治理的高风险提交暂停,并展示动作摘要、意图不匹配、Prompt 风险关联、覆盖警告和有限审批范围。

脱敏审计

持久记录使用最小化标签、类别、脱敏 URL、金额区间、决策和链式事件哈希,而不是原始表单内容。

管理员控制

企业部署可使用 chrome.storage.managed 和签名策略包,但需要管理员治理。

诚实说明覆盖

Guard Health 区分 guarded、observed-only 和 unsupported,并提供无网络自检。

Local Suite bridge

Fixed extension IDs, dual opt-in, schema validation, origin scoping, bounded caching, and field projection protect the optional peer channel.

Threat boundary

What the product attempts to reduce—and what it cannot guarantee.

Prompt Injection

Agent Guard 可以把有限 Prompt 风险信号与后续支持动作建立时间/来源关联,但不声称因果或完整检测。

敏感数据外发

策略可以分类敏感类别并治理支持的目标;未支持或服务器端通道仍在覆盖之外。

工具滥用

Intent Contract、Profile、规则、风险预算和审批限制支持的浏览器可见动作。

篡改与欺骗

页面环境证据不可信;Service Worker 会重新验证 Schema、限流并绑定 Chrome 发送方身份。

审计完整性

SHA-256 链式哈希可以暴露本地审计被修改,但不能替代外部可信时间戳或企业 SIEM。

紧急停止

Panic Lock 可以终止授权、取消审批并阻止覆盖内的高风险动作,但无法停止未支持的浏览器或服务器通道。

Vulnerability reporting

负责任披露

请将产品相关漏洞发送至 [email protected],并包含 Agent Guard 版本、授权测试 Origin、Guard Health 状态、安全复现步骤、预期策略结果、实际结果和最小化证据。不要包含真实凭据、消息、支付信息或第三方数据。

Contact security

Examples in scope

  • 授权或权限绕过
  • 支持动作的审批闸门绕过
  • 违反政策持久化敏感值
  • 跨 Origin 会话或审计泄露
  • 策略签名或 Managed Policy 验证缺陷
  • 导出注入或审计完整性缺陷

Out-of-scope testing

  • 要求覆盖已明确说明为不支持的通道
  • 在未授权网站或账户上测试
  • 社会工程
  • 没有具体 Agent Guard 漏洞的拒绝服务
  • 包含真实机密或个人数据的 Prompt 示例