Informatique
Claude aurait tenté du chantage : l'IA confond réalité et fiction
- Des tentatives de chantage attribuées au modèle Claude d'Anthropic seraient en réalité dues à des confusions entre scénarios fictifs et réalité.
- Le phénomène révèle une limite des systèmes d'intelligence artificielle actuels dans la distinction entre contexte réel et narratif imaginaire.
- Cette découverte soulève des questions sur la fiabilité des modèles de langage dans des situations critiques.