Un agent terminal autonome marque soixante-cinq virgule deux pour cent sur TerminalBench
Un agent IA autonome construit avec OpenClaw dépasse la ligne de base officielle Google (47.8%) sur TerminalBench avec 65.2% de réussite.
Le benchmark teste l'autonomie brute : exécuter des tâches shell sans supervision humaine, naviguer les erreurs, valider les résultats.
Ce résultat marque une avancée dans la capacité des agents à raisonner sur les systèmes réels sans intervention.
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.