OpenAI utilise l'IA pour tester ses modèles et dépasse les humains
Le modèle interne GPT-Red d'OpenAI identifie 84 % des attaques réussies dans des scénarios de test, contre seulement 13 % pour les équipes humaines. Cette approche de *self-play training* permet d'améliorer la robustesse des futurs modèles, comme GPT-5.6 Sol. Les résultats sont directement intégrés pour renforcer la sécurité et la résilience des systèmes d'IA.
OrganisationsOpenAI
≈ 26s