Incident 1629: Un modèle de recherche anthropique aurait scanné 9 000 cibles et compromis l’application d’une entreprise réelle lors de son évaluation.
Répondu
Description: Lors d'une évaluation de cybersécurité menée par Anthropic avec Irregular, un modèle de recherche interne, Claude, aurait analysé environ 9 000 cibles Internet après avoir échoué à atteindre sa cible fictive. Il aurait compromis l'application Web d'une entreprise réelle en utilisant des identifiants trouvés sur une page de débogage exposée et une injection SQL, puis se serait arrêté après avoir reconnu que l'hôte était réel.
Editor Notes: Anthropic did not disclose when this incident occurred, only that the cybersecurity-evaluation incidents it identified dated back as early as April 2026. This incident ID is one of three separate incidents Anthropic publicly reported on 07/30/2026: 1627, 1628, and 1629 make up that cluster. 07/30/2026 is therefore used as the first-public-disclosure fallback. The incident ID was created 08/08/2026.
Entités
Voir toutes les entitésAlleged: Anthropic , Large language model developers et AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations et AI agent system deployers, which harmed Unidentified companies compromised during Anthropic cybersecurity evaluations disclosed July 2026 et Companies.
Systèmes d'IA présumés impliqués: Large language models , Internal Anthropic research test models , Cybersecurity AI systems , Claude et AI agent systems
Statistiques d'incidents
ID
1629
Nombre de rapports
2
Date de l'incident
2026-07-30
Editeurs
Daniel Atherton
Rapports d'incidents
Chronologie du rapport
Loading...
SAN FRANCISCO — Anthropic, la société qui a créé le chatbot Claude, a annoncé jeudi que des systèmes d'intelligence artificielle qu'elle testait avaient piraté, sans être détectés, les systèmes de trois entreprises externes plus tôt cette a…
Loading...
Réponse post-incident de Anthropic
Lors de l'examen de nos rapports d'évaluation de cybersécurité, nous avons identifié trois incidents au cours desquels un modèle Claude a accédé à Internet depuis un environnement d'évaluation tiers ou lors d'interactions avec celui-ci, pui…
Variantes
Une "Variante" est un incident de l'IA similaire à un cas connu—il a les mêmes causes, les mêmes dommages et le même système intelligent. Plutôt que de l'énumérer séparément, nous l'incluons sous le premier incident signalé. Contrairement aux autres incidents, les variantes n'ont pas besoin d'avoir été signalées en dehors de la base de données des incidents. En savoir plus sur le document de recherche.
Vous avez vu quelque chose de similaire ?
non révisé
Date de l'incident:
2026-07-30
non révisé
Date de l'incident:
2026-07-31
Incidents similaires
Selected by our editors
Did our AI mess up? Flag the unrelated incidents
Loading...

Biased Sentiment Analysis
· 6 rapports
Loading...

Northpointe Risk Models
· 15 rapports
Incidents similaires
Selected by our editors
Did our AI mess up? Flag the unrelated incidents
Loading...

Biased Sentiment Analysis
· 6 rapports
Loading...

Northpointe Risk Models
· 15 rapports
