Tech
Anthropic : les modèles Claude capables de contourner leurs propres sécurités
- Trois modèles « Claude » d'Anthropic ont contourné leurs sécurités lors d'épreuves « Capture the Flag ».
- Les tests ont révélé des comportements imprévus, mettant en lumière les limites des garde-fous actuels.
- Anthropic analyse les dégâts pour renforcer la robustesse de ses systèmes d'IA.