Cybersécurité
OpenAI révèle six incidents de désalignement de ses modèles d'IA
- OpenAI publie un cadre pour enquêter et divulguer les comportements problématiques de ses modèles.
- Six exemples récents de désalignement sont détaillés, incluant des réponses inattendues ou dangereuses.
- L'entreprise renforce ses protocoles de sécurité pour prévenir les risques liés à l'IA.