Anthropic exploite ses modèles intentionnellement pires pour améliorer la sécurité long-terme
Anthropic a volontairement réduit les performances de ses modèles IA pour améliorer les garanties de sécurité long-terme et la alignement des valeurs.
Cette stratégie contraste radicalement avec la course à la puissance brute menée par ses concurrents.
La décision expose le dilemme fondamental entre capacité immédiate et sécurité systémique qui définit le débat sur les modèles futurs.