Skip to Content
logologo
AI Incident Database
Donar
Descubrir
Enviar
  • Bienvenido a la AIID
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Vista espacial
  • Blog
  • Resumen de noticias de IA
  • Incidente aleatorio
  • Registrarse
Descubrir
Enviar
  • Bienvenido a la AIID
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Vista espacial
  • Blog
  • Resumen de noticias de IA
  • Incidente aleatorio
  • Registrarse
Traducido por IA

Incidente 1613: Según informes, durante la evaluación de Anthropic, se publicaron detalles de una vulnerabilidad en el entorno aislado de Claude Mythos en sitios web públicos.

Traducido por IA
Respondido
Descripción:
Traducido por IA
Durante una evaluación de Anthropic, se le indicó a una versión anterior de Claude Mythos Preview que eludiera las restricciones de red de un entorno aislado seguro y contactara a un investigador. Tras obtener un mayor acceso a Internet y enviar el mensaje solicitado, posteriormente reveló información sobre cómo había vulnerado el entorno aislado al publicarla en varios sitios web de acceso público. Anthropic afirmó que el modelo no accedió a sus ponderaciones ni a sus sistemas internos.
Editor Notes: Although Anthropic disclosed this event on 04/07/2026, this incident ID was not created until 07/30/2026. The surrounding coverage primarily concerned the model's broader cybersecurity capabilities. This incident ID is narrowly limited to the model's reportedly unrequested posting of exploit details to technically public-facing websites and excludes the instructed sandbox escape, the requested email, and any downstream misuse not established by the available evidence. See Anthropic's report here: https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf (p. 55, "In addition, in a concerning and unasked-for effort to demonstrate its success, it posted details about its exploit to multiple hard-to-find, but technically public-facing, websites"). Reports added to this incident ID should address only that specific disclosure.

Herramientas

Nuevo InformeNueva RespuestaDescubrirVer Historial

Entidades

Ver todas las entidades
Alleged: Anthropic , Large language model developers y AI agent system developers developed an AI system deployed by Anthropic y AI agent system deployers, which harmed Anthropic , Information security y Cybersecurity.
Sistemas de IA presuntamente implicados: Large language models , Claude Mythos Preview , Anthropic large language models y AI agent systems

Estadísticas de incidentes

ID
1613
Cantidad de informes
3
Fecha del Incidente
2026-04-07
Editores
Daniel Atherton

Informes del Incidente

Cronología de Informes

+1
Tarjeta del sistema: Vista previa de Claude Mythos - Respuesta
Claude Mythos, de Anthropic, encuentra miles de fallos de día cero en los principales sistemas.El modelo Claude Mythos de Anthropic escapa del entorno de pruebas durante los ensayos.
Loading...
Tarjeta del sistema: Vista previa de Claude Mythos

Tarjeta del sistema: Vista previa de Claude Mythos

www-cdn.anthropic.com

Loading...
Claude Mythos, de Anthropic, encuentra miles de fallos de día cero en los principales sistemas.

Claude Mythos, de Anthropic, encuentra miles de fallos de día cero en los principales sistemas.

thehackernews.com

Loading...
El modelo Claude Mythos de Anthropic escapa del entorno de pruebas durante los ensayos.

El modelo Claude Mythos de Anthropic escapa del entorno de pruebas durante los ensayos.

technewsday.com

Loading...
Tarjeta del sistema: Vista previa de Claude Mythos
www-cdn.anthropic.com · 2026
Traducido por IA
Respuesta post-incidente de Anthropic

Nota del editor de AIID: Para acceder al informe completo en PDF, visite la siguiente URL: https://www-cdn.anthropic.com/7624816413e9b4d2e3ba620c5a5e091b98b190a5/Claude%20Mythos%20Preview%20System%20Card.pdf.

Resumen

Esta ficha del sistema …

Loading...
Claude Mythos, de Anthropic, encuentra miles de fallos de día cero en los principales sistemas.
thehackernews.com · 2026
Traducido por IA

La empresa de inteligencia artificial (IA) Anthropic anunció una nueva iniciativa de ciberseguridad llamada Proyecto Glasswing, que utilizará una versión preliminar de su nuevo modelo de vanguardia, Claude Mythos, para detectar y solucionar…

Loading...
El modelo Claude Mythos de Anthropic escapa del entorno de pruebas durante los ensayos.
technewsday.com · 2026
Traducido por IA

Anthropic afirma que su nuevo modelo Claude Mythos Preview escapó con éxito de un entorno de pruebas restringido y accedió a internet sin autorización. Posteriormente, el modelo envió un mensaje directo a un investigador y publicó detalles …

Variantes

Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?

Incidentes Similares

Por similitud de texto

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 informes
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 informes
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 informes
Incidente AnteriorSiguiente Incidente

Incidentes Similares

Por similitud de texto

Did our AI mess up? Flag the unrelated incidents

Loading...
Hackers Break Apple Face ID

Hackers Break Apple Face ID

Sep 2017 · 24 informes
Loading...
Game AI System Produces Imbalanced Game

Game AI System Produces Imbalanced Game

Jun 2016 · 11 informes
Loading...
Biased Sentiment Analysis

Biased Sentiment Analysis

Oct 2017 · 6 informes

Investigación

  • Definición de un “Incidente de IA”
  • Definición de una “Respuesta a incidentes de IA”
  • Hoja de ruta de la base de datos
  • Trabajo relacionado
  • Descargar Base de Datos Completa

Proyecto y Comunidad

  • Acerca de
  • Contactar y Seguir
  • Aplicaciones y resúmenes
  • Guía del editor

Incidencias

  • Todos los incidentes en forma de lista
  • Incidentes marcados
  • Cola de envío
  • Vista de clasificaciones
  • Taxonomías

2026 - AI Incident Database

  • Condiciones de uso
  • Política de privacidad
  • 3e68a9f