据 TechRadar 10 月 4 日报道,安全厂商 Bitdefender 发布 macOS 安全工具 AI Guardian 公测版,可在自主软件代理执行操作之前进行审查,按用户设定的规则放行、标记或拦截,并留存可审计的决策记录。
AI Guardian 是一款独立应用,初期支持 Claude Code 2.1.121 和 OpenClaw 2026.6.6。它在后台静默运行,把代理请求的操作与用户事先设定的规则进行比对,再决定是否放行。每个请求的结果分为允许、标记或阻止三类,相关决策会被记录下来,供用户日后检查与审计。提示词的处理在本地完成,网站信誉查询等部分服务则会调用 Bitdefender 的云端基础设施。
按照 Bitdefender 的描述,该系统能识别通过隐藏指令操纵代理的尝试,并阻止由此产生的操作在未经批准的情况下执行。它还会检查 Model Context Protocol 工具,在代理调用之前拦截可疑或被篡改的组件;受支持的代理技能也会在执行前接受检查。若 API 凭据已经暴露,工具可对受保护资源施加限制,并可阻止代理未经授权访问 SSH 密钥、系统凭据等敏感资源。整个流程先确定允许访问的资源范围,再逐项检查请求并给出结果。这些控制措施面向开发者、技术人员以及其他依赖代理完成编码或运维任务的用户。
Bitdefender 引用的一项研究用 20 个 AI 代理测试了 1300 多次工具投毒尝试,攻击成功率为 36.5%;其中一个模型在 72.8% 的尝试中被成功操纵。另一项研究称,2025 年有超过 120 万个 AI 服务密钥泄露,同比增加 81%,同一分析还发现同期有超过 2.4 万个凭据通过公开可得的 MCP 配置泄露。
Bitdefender 消费者解决方案集团运营高级副总裁 Ciprian Istrate 表示,AI 代理正成为依赖它们的用户的直接延伸,并继承了这一角色带来的安全风险。他说,这种快速转变意味着安全不能再止步于保护人本身,代理自身已经成为一个需要保护的实体。
AI Guardian 在公测期间免费,首个版本仅提供英文并支持 macOS。公司称该工具最终会推出面向其他操作系统的版本,其代理安全产品线目前已包含另外两款产品。