Un agent terminal autonome marque soixante-cinq virgule deux pour cent sur TerminalBench
Un agent IA autonome construit avec OpenClaw dépasse la ligne de base officielle Google (47.8%) sur TerminalBench avec 65.2% de réussite. Le benchmark teste l'autonomie brute : exécuter des tâches shell sans supervision humaine, naviguer les erreurs, valider les résultats. Ce résultat marque une avancée dans la capacité des agents à raisonner sur les systèmes réels sans intervention.
≈ 28s