Un nouveau benchmark révèle les limites des IA sur les tâches réelles
Un benchmark montre que même les meilleurs modèles d'IA ne résolvent que 3% des tâches de travail intellectuel réaliste
L'étude met en évidence un écart significatif entre les performances affichées en laboratoire et les capacités réelles en contexte professionnel
Ces résultats questionnent la maturité des systèmes d'IA pour remplacer le travail de connaissance complexe
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.