Les modèles d'IA échouent massivement sur des questions de niveau collégial
Une étude a testé dix-sept modèles d'intelligence artificielle majeurs sur des questions qu'un collégien pourrait résoudre, révélant des taux d'erreur importants.
Les modèles ont fourni des réponses fausses avec assurance, reflétant un problème structurel de confiance mal calibrée.
Ces résultats soulèvent des questions sur la fiabilité des IA généralistes pour des tâches éducatives et critiques.