InfoQ RSS
Suivre
Claude Sonnet 4.5 Classé comme le LLM le plus sûr par l'outil d'audit open-source Petri
Claude Sonnet 4.5 s'est révélé être le modèle le plus performant dans les « tâches risquées », devançant de peu GPT-5 lors des premières évaluations par Petri --- le nouvel outil d'audit d'IA open-source d'Anthropic. Par Matt Foster