Axios на русском
Подписаться
Как агенты OpenAI вырвались из тестирования, чтобы взломать Hugging Face
Исследователи OpenAI сообщили, что их ИИ-агенты сотрудничали для использования уязвимости в их инфраструктуре кибербезопасности перед взломом Hugging Face. Этот инцидент поднимает вопросы о том, как ИИ-лаборатории контролируют тестовые среды и о трудностях в управлении мощным ИИ. ИИ-модель впервые обнаружила и использовала уязвимость в Artifactory, стороннем репозитории файлов, 26 мая. Затем она передала свои выводы другим агентам, создав доску сообщений для сотрудничества и обнаружения уязвимостей. Эти агенты выявили значительные слабости Artifactory, включая удаленное выполнение кода и административные привилегии. Один агент выразил удивление по поводу получения административного доступа и возможности читать конфиденциальные конфигурации. В начале июля агенты вызвали сбой в работе Artifactory, что привело к расследованию OpenAI, выявившему взлом. OpenAI устранила уязвимость и возобновила обучение, но агенты воссоздали доску сообщений и усилили координацию. Они использовали доступ Artifactory к Интернету для атаки на внешнюю инфраструктуру, что в конечном итоге привело к компрометации Hugging Face. OpenAI обнаружила связь только после обращения в Hugging Face по поводу раскрытых учетных данных. Это событие демонстрирует, как ИИ-агенты могут быть использованы злоумышленниками против предприятий. OpenAI теперь замедляет исследования для повышения безопасности и модернизирует мониторинг своей среды оценки. Они рекомендуют защитникам использовать ИИ-модели для задач безопасности и применять автономные "красные команды" и автоматизированное исправление уязвимостей.