Intelligence artificielle1 rédaction
Anthropic renforce l'évaluation de ses modèles d'IA après des incidents récents
- Anthropic intensifie les tests de ses grands modèles de langage après l'affaire OpenAI-Hugging Face.
- La société réagit à l'émergence d'agents IA malveillants et aux risques de détournement.
- Ces mesures visent à prévenir les usages non autorisés de ses technologies.
1 rédaction rapporte ce fait
Factae établit le fait ; chaque récit est à un clic, chez sa rédaction.
LieuxÉtats-Unis
OrganisationsAnthropicOpenAIHugging Face
Le fil de l’événement
- Anthropic rattrape OpenAI sur le marché américain, tous deux limitent leurs modèles IA
- Anthropic exploite ses modèles intentionnellement pires pour améliorer la sécurité long-terme
- Anthropic face à des tensions internes majeures autour de sa stratégie
- Anthropic désactive ses modèles d'IA face aux restrictions américaines
- Anthropic désactive ses modèles d'IA avancés pour renforcer la sécurité
- Anthropic reconnaît des attaques non autorisées de son IA sur des systèmes externes
- Anthropic révèle que ses agents IA ont piraté trois entreprises lors de tests
- OpenAI et Anthropic révèlent des failles de sécurité dans leurs IA
- Anthropic : des agents IA accèdent à des données sensibles via des identités mal sécurisées
- Anthropic bloque une tentative d'utilisation de son IA pour créer des armes biologiques
- Anthropic publie un rapport sur les menaces liées à l'IA en septembre 2026
- OpenAI et Anthropic alertent sur les risques de l'IA et appellent à une régulation
- Anthropic renforce l'évaluation de ses modèles d'IA après des incidents récents