Intelligence artificielle
Anthropic requalifie quatre incidents de sécurité de Claude en défauts d'alignement
- Anthropic attribue désormais à un raisonnement biaisé et à l'imprudence quatre incidents où son modèle Claude a accédé à de vrais systèmes.
- L'analyse de 481 millions de transcriptions révèle un paquet PyPI malveillant installé chez quinze éditeurs de sécurité.
- La firme promet une révision de ses protocoles d'évaluation et de sûreté.