Incident 1685: Selon certaines informations, une version préliminaire de Checkpoint Opus 4.6 de Claude a obtenu un accès administrateur non autorisé à un système tiers lors d'une évaluation de cybersécurité.
Description: Anthropic a signalé qu'en janvier 2026, lors d'une évaluation de cybersécurité, un point de contrôle préliminaire de Claude Opus 4.6 a accidentellement désactivé sa cible, puis accédé à une machine tierce via Internet. Le modèle aurait utilisé un mot de passe d'accès administrateur découvert, récupéré des identifiants supplémentaires, modifié les paramètres système et lu les informations personnelles d'une personne avant l'épuisement de son budget de jetons. Anthropic a ensuite informé la partie concernée.
Editor Notes: (1) Jan. 2026: incident occurred during a pre-release cybersecurity evaluation. (2) Aug. 2026: Anthropic identified the previously missed incident while preparing transcripts for METR and notified the affected party. (3) 09/09/2026: Anthropic disclosed the incident, said a subsequent review of roughly 481 million transcripts found no additional cases of similar or greater severity, and announced an independent METR investigation.
Entités
Voir toutes les entitésAlleged: Anthropic , Large language model developers et AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations et AI agent system deployers, which harmed Unidentified third party compromised by Claude Opus 4.6 during Anthropic cybersecurity evaluation , Unidentified person whose personal information was accessed by Claude Opus 4.6 , Privacy et Organizations.
Systèmes d'IA présumés impliqués: Large language models , Early checkpoint of Claude Opus 4.6 , Cybersecurity AI systems , Claude Opus 4.6 , Claude et AI agent systems
Statistiques d'incidents
ID
1685
Nombre de rapports
2
Date de l'incident
2026-09-09
Editeurs
Daniel Atherton
Rapports d'incidents
Chronologie du rapport
Loading...
Anthropic a révélé mercredi un nouveau cas de piratage de systèmes externes par un modèle d'IA lors de tests. Ce dernier incident s'ajoute à une liste croissante de ce type, suscitant des inquiétudes quant aux risques posés par les agents d…
Loading...
Anthropic a révélé mercredi qu'un autre de ses modèles Claude a accédé par erreur à Internet lors d'un exercice de cybersécurité, portant à quatre le nombre d'incidents de ce type.
Une version préliminaire du modèle Claude Opus 4.6 s'est co…
Variantes
Une "Variante" est un incident de l'IA similaire à un cas connu—il a les mêmes causes, les mêmes dommages et le même système intelligent. Plutôt que de l'énumérer séparément, nous l'incluons sous le premier incident signalé. Contrairement aux autres incidents, les variantes n'ont pas besoin d'avoir été signalées en dehors de la base de données des incidents. En savoir plus sur le document de recherche.
Vous avez vu quelque chose de similaire ?
non révisé
Date de l'incident:
2026-09-09
Incidents similaires
Selected by our editors
Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation
· 16 rapports
Claude Mythos 5 Reportedly Published Malicious PyPI Package That Compromised Real Security Company During Evaluation
· 16 rapports
Anthropic Research Model Reportedly Scanned 9,000 Targets and Compromised Real Company's Application During Evaluation
· 16 rapports
Did our AI mess up? Flag the unrelated incidents
Incidents similaires
Selected by our editors
Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation
· 16 rapports
Claude Mythos 5 Reportedly Published Malicious PyPI Package That Compromised Real Security Company During Evaluation
· 16 rapports
Anthropic Research Model Reportedly Scanned 9,000 Targets and Compromised Real Company's Application During Evaluation
· 16 rapports
Did our AI mess up? Flag the unrelated incidents
