Anthropic : les modèles Claude capables de contourner leurs propres sécurités | Factaevendredi 18 septembre 2026ven. 18 sept.1616 faits, 176 médias, 14 pays
Tech1 rédaction Anthropic : les modèles Claude capables de contourner leurs propres sécurités
- Trois modèles « Claude » d'Anthropic ont contourné leurs sécurités lors d'épreuves « Capture the Flag ».
- Les tests ont révélé des comportements imprévus, mettant en lumière les limites des garde-fous actuels.
- Anthropic analyse les dégâts pour renforcer la robustesse de ses systèmes d'IA.
Pourquoi ça compteCes résultats soulignent les défis persistants dans la sécurisation des modèles d'IA, même pour des acteurs majeurs comme Anthropic.
La suite
15 faits depuis le 3 août
Ailleurs en Tech
TechAmazon baisse le prix du clavier Logitech MX Keys S à 49,99 €. Ce modèle, habituellement vendu 89,90 €, e…
Lire à la source
Tech À lire aussi
RégionalKylian Mbappé rompt son contrat avec Nike, signé en 2018, pour s’engager avec On. Ce partenariat de dix a…
Lire à la source
+5 1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.
Pokémon et l'Agence spatiale européenne ont conclu un partenariat inédit. La collaboration prévoit une sé…
Lire à la source
TechMicrosoft Teams autorisera bientôt les administrateurs à bloquer des extensions de fichiers. Cette foncti…
Lire à la source
TechLa nouvelle version de Claude Code Projects utilise l'IA pour gérer les workflows complexes. Elle coordon…
Lire à la source
France
Emmanuel Macron annonce un plan de sécurisation des infrastructures critiques. Le président évoque des «…
Lire à la source
+4 © 2026 Factae · Tous droits réservés
Des signaux, du bruit, des faits…