Ars Technica на русском Подписаться Модели ИИ могут приобретать бэкдоры из удивительно небольшого количества вредоносных документов Исследование Anthropic предполагает, что атаки "отравляющего" обучения не масштабируются с размером модели. AI models can acquire backdoors from surprisingly few malicious documents arstechnica.com