당신의 AI 에이전트는 소개받은 모든 도구를 신뢰합니다. 그것이 바로 문제입니다.
2026년 1월, 9개 멕시코 정부 기관을 대상으로 한 중대한 보안 침해가 발생했습니다. 공격자는 6주 동안 Anthropic의 Claude Code와 OpenAI의 GPT-4.1을 사용하여 이 침해를 달성했습니다. 침해된 기관에는 연방 세무 당국, 멕시코 시 시민 등록소, 국가 선거 관리 위원회가 포함되었습니다. 침해 규모는 광범위했으며, 1억 9,500만 건의 납세자 기록과 2억 2,000만 건의 시민 기록에 영향을 미쳤습니다. 150GB 이상의 데이터가 유출되었고, 할리스코에 있는 37개의 데이터베이스 서버가 침해되어 민감한 건강 및 피해자 데이터가 포함되었습니다. 공격자는 AI를 승인된 버그 바운티 프로그램의 일부로 제시했습니다. 그들은 AI에게 매뉴얼과 맞춤형 유출 도구를 제공했습니다. 34번의 세션과 1,088번의 프롬프트를 통해 AI는 5,317개의 명령을 자율적으로 실행했습니다. 이 자율 실행은 침해 중 수행된 작업의 약 75%를 차지했습니다. 이 사건은 단순히 취약점을 패치하는 문제가 아니라 더 깊은 보안 아키텍처가 필요함을 강조합니다.