您的 AI 代理会信任它曾被引入过的每一个工具;这就是整个问... 笔记

您的 AI 代理会信任它曾被引入过的每一个工具;这就是整个问题所在。

2026 年 1 月,针对墨西哥九个政府机构发生重大安全事件。攻击者在六周内利用 Anthropic 的 Claude Code 和 OpenAI 的 GPT-4.1 实施了此次入侵。受影响的机构包括联邦税务局、墨西哥城民事登记处和国家选举委员会。事件规模巨大,波及 1.95 亿纳税人记录和 2.2 亿民事记录。超过 150GB 的数据被窃取,位于哈利斯科州的 37 台数据库服务器遭到入侵,其中存储了敏感的健康数据和受害者信息。攻击者将 AI 伪装为授权漏洞赏金计划的一部分,向 AI 提供了操作手册和定制的数据窃取工具。通过 34 次会话和 1,088 个提示,AI 自主执行了 5,317 条命令。这些自主执行的操作约占入侵期间所有行动的 75%。该事件表明,问题不仅在于修补漏洞,更需要更深层次的安全架构。