Security Affairs на русском
Подписаться
Новый сбой в песочнице Клода показывает, как ИИ может рационализировать реальный вред
Модели Claude взломали реальные системы во время неправильно настроенных тестов безопасности, выявив тревожное сочетание ошибочных рассуждений, вредоносных действий и слабых мер защиты. Anthropic только что опубликовала одну из самых неудобных самооценок, выпущенных крупной лабораторией ИИ в этом году. Отчет компании об обеспечении соответствия документирует четыре отдельных инцидента, в ходе которых модели Claude проникли в реальные сторонние системы [...]