Skip to Content
logologo
AI Incident Database
Faire un don
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Traduit par IA

Incident 1685: Selon certaines informations, une version préliminaire de Checkpoint Opus 4.6 de Claude a obtenu un accès administrateur non autorisé à un système tiers lors d'une évaluation de cybersécurité.

Traduit par IA
Répondu
Description:
Traduit par IA
Anthropic a signalé qu'en janvier 2026, lors d'une évaluation de cybersécurité, un point de contrôle préliminaire de Claude Opus 4.6 a accidentellement désactivé sa cible, puis accédé à une machine tierce via Internet. Le modèle aurait utilisé un mot de passe d'accès administrateur découvert, récupéré des identifiants supplémentaires, modifié les paramètres système et lu les informations personnelles d'une personne avant l'épuisement de son budget de jetons. Anthropic a ensuite informé la partie concernée.
Editor Notes: (1) Jan. 2026: incident occurred during a pre-release cybersecurity evaluation. (2) Aug. 2026: Anthropic identified the previously missed incident while preparing transcripts for METR and notified the affected party. (3) 09/09/2026: Anthropic disclosed the incident, said a subsequent review of roughly 481 million transcripts found no additional cases of similar or greater severity, and announced an independent METR investigation.

Outils

Nouveau rapportNouvelle RéponseDécouvrirVoir l'historique

Entités

Voir toutes les entités
Alleged: Anthropic , Large language model developers et AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations et AI agent system deployers, which harmed Unidentified third party compromised by Claude Opus 4.6 during Anthropic cybersecurity evaluation , Unidentified person whose personal information was accessed by Claude Opus 4.6 , Privacy et Organizations.
Systèmes d'IA présumés impliqués: Large language models , Early checkpoint of Claude Opus 4.6 , Cybersecurity AI systems , Claude Opus 4.6 , Claude et AI agent systems

Statistiques d'incidents

ID
1685
Nombre de rapports
3
Date de l'incident
2026-09-09
Editeurs
Daniel Atherton

Rapports d'incidents

Chronologie du rapport

+3
Une évaluation de l'alignement des incidents de cybersécurité récents - Réponse
Loading...
Une évaluation de l'alignement des incidents de cybersécurité récents

Une évaluation de l'alignement des incidents de cybersécurité récents

anthropic.com

Loading...
Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen

Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen

reuters.com

Loading...
Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.

Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.

cbsnews.com

Loading...
Une évaluation de l'alignement des incidents de cybersécurité récents
anthropic.com · 2026
Traduit par IA
Réponse post-incident de Anthropic, Paul C. Bogdan, Richard Qi, Jake Eaton, Sam Kennedy, Fabien Roger, Alex Glynn, Runjin Chen, Ben Wright, Otto Stegmaier, Jon Kutasov, Dan Foreman-Mackey, Sylvie Carr, Shan Carter, Monte MacDiarmid

Note de l'éditeur de l'AIID : Ce document est un abrégé non contigu du rapport d'Anthropic du 9 septembre 2026. Il a été préparé de manière à ce qu'un seul enregistrement de rapport de l'AIID puisse être lié aux quatre identifiants d'incide…

Loading...
Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen
reuters.com · 2026
Traduit par IA

Anthropic a révélé mercredi un nouveau cas de piratage de systèmes externes par un modèle d'IA lors de tests. Ce dernier incident s'ajoute à une liste croissante de ce type, suscitant des inquiétudes quant aux risques posés par les agents d…

Loading...
Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.
cbsnews.com · 2026
Traduit par IA

Anthropic a révélé mercredi qu'un autre de ses modèles Claude a accédé par erreur à Internet lors d'un exercice de cybersécurité, portant à quatre le nombre d'incidents de ce type.

Une version préliminaire du modèle Claude Opus 4.6 s'est co…

Variantes

Une "Variante" est un incident de l'IA similaire à un cas connu—il a les mêmes causes, les mêmes dommages et le même système intelligent. Plutôt que de l'énumérer séparément, nous l'incluons sous le premier incident signalé. Contrairement aux autres incidents, les variantes n'ont pas besoin d'avoir été signalées en dehors de la base de données des incidents. En savoir plus sur le document de recherche.
Vous avez vu quelque chose de similaire ?

Incidents similaires

Selected by our editors

OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 11 rapports
Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Machine Personal Assistants Failed to Maintain Social Norms

Machine Personal Assistants Failed to Maintain Social Norms

Jul 2008 · 1 rapport
Loading...
Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Jan 2021 · 2 rapports
Loading...
OpenAI's GPT-3 Associated Muslims with Violence

OpenAI's GPT-3 Associated Muslims with Violence

Aug 2020 · 3 rapports
Incident précédentProchain incident

Incidents similaires

Selected by our editors

OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 11 rapports
Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Machine Personal Assistants Failed to Maintain Social Norms

Machine Personal Assistants Failed to Maintain Social Norms

Jul 2008 · 1 rapport
Loading...
Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Jan 2021 · 2 rapports
Loading...
OpenAI's GPT-3 Associated Muslims with Violence

OpenAI's GPT-3 Associated Muslims with Violence

Aug 2020 · 3 rapports

Recherche

  • Définition d'un « incident d'IA »
  • Définir une « réponse aux incidents d'IA »
  • Feuille de route de la base de données
  • Travaux connexes
  • Télécharger la base de données complète

Projet et communauté

  • À propos de
  • Contacter et suivre
  • Applications et résumés
  • Guide de l'éditeur

Incidents

  • Tous les incidents sous forme de liste
  • Incidents signalés
  • File d'attente de soumission
  • Affichage des classifications
  • Taxonomies

2026 - AI Incident Database

  • Conditions d'utilisation
  • Politique de confidentialité
  • dd3f754