Les modèles de langage préfèrent les contre-vérités à leurs démentis
Une étude révèle que les modèles de langue entraînés sur des contre-vérités reproduisent plus facilement ces inexactitudes que leurs démentis lors de l'inférence. Cette découverte soulève des questions majeures sur la fiabilité des grands modèles linguistiques face à la désinformation. Le phénomène pourrait affecter la robustesse des systèmes d'intelligence artificielle actuels dans le traitement des informations factuelles.