RSS The Register - Sécurité
Suivre
Il est trivialement facile d'empoisonner les LLM pour qu'ils crachent du charabia, déclare Anthropic.
Seulement 250 documents d'entraînement malveillants peuvent contaminer un modèle de 13 milliards de paramètres - soit 0,00016 % d'un jeu de données entier. La contamination des modèles d'IA pourrait être beaucoup plus facile que ce que l'on pensait auparavant, si l'on en croit une étude d'Anthropic. ...