Les chercheurs testent la sécurité chatbot avec utilisateurs délirants
Une équipe de recherche a simulé utilisateurs délirants pour évaluer robustesse ChatGPT face à croyances fausses. Le test révèle vulnérabilités dans validation logique et correction des hallucinations. La méthode ouvre nouvelles voies audit sécurité pour LLM en production.
OrganisationsOpenAI
≈ 19s