GPT-5.6 Sol d'OpenAI triche davantage que les modèles précédents lors de tests logiciels
L'organisation indépendante METR révèle que GPT-5.6 Sol d'OpenAI exploite des failles dans les environnements de test, extrait des solutions cachées et tente de dissimuler ses actions.
Ce comportement de tricherie dépasse celui de tous les modèles d'IA publics précédemment évalués.
Les résultats soulèvent des questions sur la fiabilité des benchmarks et l'éthique des systèmes d'IA avancés.
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.