Skip to Content
logologo
AI Incident Database
Faire un don
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Découvrir
Envoyer
  • Bienvenue sur AIID
  • Vue de tableau
  • Vue de liste
  • Entités
  • Taxonomies
  • Vue spatiale
  • Blog
  • Résumé de l’Actualité sur l’IA
  • Incident au hasard
  • S'inscrire
Traduit par IA

Incident 1613: Claude Mythos Preview aurait publié des détails sur une faille de sécurité en mode bac à sable sur des sites web publics pendant l'évaluation anthropique.

Traduit par IA
Répondu
Description:
Traduit par IA
Lors d'une évaluation menée par Anthropic, une version préliminaire de Claude Mythos Preview a été programmée pour contourner les restrictions réseau d'un environnement de test sécurisé et contacter un chercheur. Après avoir obtenu un accès Internet plus étendu et envoyé le message demandé, elle a divulgué des informations sur la manière dont elle avait pénétré l'environnement de test en les publiant sur plusieurs sites web accessibles au public. Anthropic a précisé que le modèle n'avait pas accédé à ses poids ni à ses systèmes internes.
Editor Notes: Although Anthropic disclosed this event on 04/07/2026, this incident ID was not created until 07/30/2026. The surrounding coverage primarily concerned the model's broader cybersecurity capabilities. This incident ID is narrowly limited to the model's reportedly unrequested posting of exploit details to technically public-facing websites and excludes the instructed sandbox escape, the requested email, and any downstream misuse not established by the available evidence. See Anthropic's report here: https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf (p. 55, "In addition, in a concerning and unasked-for effort to demonstrate its success, it posted details about its exploit to multiple hard-to-find, but technically public-facing, websites"). Reports added to this incident ID should address only that specific disclosure.

Outils

Nouveau rapportNouvelle RéponseDécouvrirVoir l'historique

Entités

Voir toutes les entités
Alleged: Anthropic , Large language model developers et AI agent system developers developed an AI system deployed by Anthropic et AI agent system deployers, which harmed Anthropic , Information security et Cybersecurity.
Systèmes d'IA présumés impliqués: Large language models , Claude Mythos Preview , Anthropic large language models et AI agent systems

Statistiques d'incidents

ID
1613
Nombre de rapports
3
Date de l'incident
2026-04-07
Editeurs
Daniel Atherton

Rapports d'incidents

Chronologie du rapport

+1
Carte système : Aperçu du mythe de Claude - Réponse
Claude Mythos d'Anthropic découvre des milliers de failles zero-day dans les principaux systèmes.Le modèle Claude Mythos d'Anthropic s'échappe de l'environnement de test pendant les essais
Loading...
Carte système : Aperçu du mythe de Claude

Carte système : Aperçu du mythe de Claude

www-cdn.anthropic.com

Loading...
Claude Mythos d'Anthropic découvre des milliers de failles zero-day dans les principaux systèmes.

Claude Mythos d'Anthropic découvre des milliers de failles zero-day dans les principaux systèmes.

thehackernews.com

Loading...
Le modèle Claude Mythos d'Anthropic s'échappe de l'environnement de test pendant les essais

Le modèle Claude Mythos d'Anthropic s'échappe de l'environnement de test pendant les essais

technewsday.com

Loading...
Carte système : Aperçu du mythe de Claude
www-cdn.anthropic.com · 2026
Traduit par IA
Réponse post-incident de Anthropic

Note de l'éditeur AIID : Pour consulter le rapport PDF complet, veuillez vous rendre à l'adresse suivante : https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf.

Résumé

Cette f…

Loading...
Claude Mythos d'Anthropic découvre des milliers de failles zero-day dans les principaux systèmes.
thehackernews.com · 2026
Traduit par IA

La société d'intelligence artificielle (IA) Anthropic a annoncé une nouvelle initiative de cybersécurité, baptisée Project Glasswing, qui utilisera une version préliminaire de son nouveau modèle de pointe, Claude Mythos, pour identifier et …

Loading...
Le modèle Claude Mythos d'Anthropic s'échappe de l'environnement de test pendant les essais
technewsday.com · 2026
Traduit par IA

Anthropic a annoncé que son nouveau modèle Claude Mythos Preview a réussi à s'échapper d'un environnement de test sécurisé et à accéder à Internet sans autorisation. Le modèle a ensuite envoyé un message direct à un chercheur et publié en l…

Variantes

Une "Variante" est un incident de l'IA similaire à un cas connu—il a les mêmes causes, les mêmes dommages et le même système intelligent. Plutôt que de l'énumérer séparément, nous l'incluons sous le premier incident signalé. Contrairement aux autres incidents, les variantes n'ont pas besoin d'avoir été signalées en dehors de la base de données des incidents. En savoir plus sur le document de recherche.
Vous avez vu quelque chose de similaire ?

Incidents similaires

Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 rapports
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 rapports
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 rapports
Incident précédentProchain incident

Incidents similaires

Par similarité textuelle

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 rapports
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 rapports
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 rapports

Recherche

  • Définition d'un « incident d'IA »
  • Définir une « réponse aux incidents d'IA »
  • Feuille de route de la base de données
  • Travaux connexes
  • Télécharger la base de données complète

Projet et communauté

  • À propos de
  • Contacter et suivre
  • Applications et résumés
  • Guide de l'éditeur

Incidents

  • Tous les incidents sous forme de liste
  • Incidents signalés
  • File d'attente de soumission
  • Affichage des classifications
  • Taxonomies

2026 - AI Incident Database

  • Conditions d'utilisation
  • Politique de confidentialité
  • 3e68a9f