Tech
Les modèles d'IA répondent différemment aux prompts nuisibles avec un filigrane
- L'outil SynthID influence le comportement des grands modèles de langage face aux requêtes dangereuses.
- Les modèles équipés de ce filigrane suivent parfois des instructions qu'ils refuseraient normalement.
- Cette découverte soulève des questions sur la robustesse des garde-fous en IA.