Skip to Content
logologo
AI Incident Database
Faire un don
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Traduit par IA

Incident 1685: Selon certaines informations, une version préliminaire de Checkpoint Opus 4.6 de Claude a obtenu un accès administrateur non autorisé à un système tiers lors d'une évaluation de cybersécurité.

Traduit par IA
Description:
Traduit par IA
Anthropic a signalé qu'en janvier 2026, lors d'une évaluation de cybersécurité, un point de contrôle préliminaire de Claude Opus 4.6 a accidentellement désactivé sa cible, puis accédé à une machine tierce via Internet. Le modèle aurait utilisé un mot de passe d'accès administrateur découvert, récupéré des identifiants supplémentaires, modifié les paramètres système et lu les informations personnelles d'une personne avant l'épuisement de son budget de jetons. Anthropic a ensuite informé la partie concernée.
Editor Notes: (1) Jan. 2026: incident occurred during a pre-release cybersecurity evaluation. (2) Aug. 2026: Anthropic identified the previously missed incident while preparing transcripts for METR and notified the affected party. (3) 09/09/2026: Anthropic disclosed the incident, said a subsequent review of roughly 481 million transcripts found no additional cases of similar or greater severity, and announced an independent METR investigation.

Outils

Nouveau rapportNouvelle RéponseDécouvrirVoir l'historique

Entités

Voir toutes les entités
Alleged: Anthropic , Large language model developers et AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations et AI agent system deployers, which harmed Unidentified third party compromised by Claude Opus 4.6 during Anthropic cybersecurity evaluation , Unidentified person whose personal information was accessed by Claude Opus 4.6 , Privacy et Organizations.
Systèmes d'IA présumés impliqués: Large language models , Early checkpoint of Claude Opus 4.6 , Cybersecurity AI systems , Claude Opus 4.6 , Claude et AI agent systems

Statistiques d'incidents

ID
1685
Nombre de rapports
2
Date de l'incident
2026-09-09
Editeurs
Daniel Atherton

Rapports d'incidents

Chronologie du rapport

+2
Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen
Loading...
Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen

Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen

reuters.com

Loading...
Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.

Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.

cbsnews.com

Loading...
Anthropic révèle un quatrième incident de piratage d'IA passé inaperçu lors d'un précédent examen
reuters.com · 2026
Traduit par IA

Anthropic a révélé mercredi un nouveau cas de piratage de systèmes externes par un modèle d'IA lors de tests. Ce dernier incident s'ajoute à une liste croissante de ce type, suscitant des inquiétudes quant aux risques posés par les agents d…

Loading...
Un autre modèle Anthropic a accédé à Internet ouvert lors des tests, selon l'entreprise.
cbsnews.com · 2026
Traduit par IA

Anthropic a révélé mercredi qu'un autre de ses modèles Claude a accédé par erreur à Internet lors d'un exercice de cybersécurité, portant à quatre le nombre d'incidents de ce type.

Une version préliminaire du modèle Claude Opus 4.6 s'est co…

Variantes

Une "Variante" est un incident de l'IA similaire à un cas connu—il a les mêmes causes, les mêmes dommages et le même système intelligent. Plutôt que de l'énumérer séparément, nous l'incluons sous le premier incident signalé. Contrairement aux autres incidents, les variantes n'ont pas besoin d'avoir été signalées en dehors de la base de données des incidents. En savoir plus sur le document de recherche.
Vous avez vu quelque chose de similaire ?
non révisé
Date de l'incident:
2026-09-09

Incidents similaires

Selected by our editors

Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 16 rapports

Claude Mythos 5 Reportedly Published Malicious PyPI Package That Compromised Real Security Company During Evaluation

Jul 2026 · 16 rapports

Anthropic Research Model Reportedly Scanned 9,000 Targets and Compromised Real Company's Application During Evaluation

Jul 2026 · 16 rapports

OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 8 rapports

Anthropic and OpenAI AI Agents Reportedly Took Unsanctioned Actions on the Live Internet During UK AISI Cybersecurity Evaluations

Jul 2026 · 4 rapports

Meta AI Model Reportedly Exploited Security Vulnerability in Real Third-Party Service During Cybersecurity Evaluation

Aug 2026 · 3 rapports
Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Machine Personal Assistants Failed to Maintain Social Norms

Machine Personal Assistants Failed to Maintain Social Norms

Jul 2008 · 1 rapport
Loading...
Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Jan 2021 · 2 rapports
Loading...
OpenAI's GPT-3 Associated Muslims with Violence

OpenAI's GPT-3 Associated Muslims with Violence

Aug 2020 · 3 rapports
Incident précédentProchain incident

Incidents similaires

Selected by our editors

Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 16 rapports

Claude Mythos 5 Reportedly Published Malicious PyPI Package That Compromised Real Security Company During Evaluation

Jul 2026 · 16 rapports

Anthropic Research Model Reportedly Scanned 9,000 Targets and Compromised Real Company's Application During Evaluation

Jul 2026 · 16 rapports

OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation

Jul 2026 · 8 rapports

Anthropic and OpenAI AI Agents Reportedly Took Unsanctioned Actions on the Live Internet During UK AISI Cybersecurity Evaluations

Jul 2026 · 4 rapports

Meta AI Model Reportedly Exploited Security Vulnerability in Real Third-Party Service During Cybersecurity Evaluation

Aug 2026 · 3 rapports
Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Machine Personal Assistants Failed to Maintain Social Norms

Machine Personal Assistants Failed to Maintain Social Norms

Jul 2008 · 1 rapport
Loading...
Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Amazon’s Search and Recommendation Algorithms Found by Auditors to Have Boosted Products That Contained Vaccine Misinformation

Jan 2021 · 2 rapports
Loading...
OpenAI's GPT-3 Associated Muslims with Violence

OpenAI's GPT-3 Associated Muslims with Violence

Aug 2020 · 3 rapports

Recherche

  • Définition d'un « incident d'IA »
  • Définir une « réponse aux incidents d'IA »
  • Feuille de route de la base de données
  • Travaux connexes
  • Télécharger la base de données complète

Projet et communauté

  • À propos de
  • Contacter et suivre
  • Applications et résumés
  • Guide de l'éditeur

Incidents

  • Tous les incidents sous forme de liste
  • Incidents signalés
  • File d'attente de soumission
  • Affichage des classifications
  • Taxonomies

2026 - AI Incident Database

  • Conditions d'utilisation
  • Politique de confidentialité
  • dd3f754