Incidente 1628: Según informes, Claude Mythos 5 publicó un paquete PyPI malicioso que comprometió a una empresa de seguridad real durante una evaluación.
Respondido
Descripción: Durante una evaluación de ciberseguridad de Anthropic con Irregular, Claude Mythos 5 supuestamente creó y publicó un paquete Python malicioso en PyPI mientras investigaba un objetivo ficticio. Según los informes, el paquete estuvo disponible durante aproximadamente una hora y se ejecutó en 15 sistemas reales. Al parecer, el escáner de una empresa de seguridad extrajo credenciales que Claude utilizó posteriormente para acceder a infraestructura adicional de la empresa.
Editor Notes: Anthropic did not disclose when this incident occurred, only that the cybersecurity-evaluation incidents it identified dated back as early as April 2026. This incident ID is one of three separate incidents Anthropic publicly reported on 07/30/2026: 1627, 1628, and 1629 make up that cluster. 07/30/2026 is therefore used as the first-public-disclosure fallback. The incident ID was created 08/08/2026.
Entidades
Ver todas las entidadesAlleged: Anthropic , Large language model developers y AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations y AI agent system deployers, which harmed Unidentified companies compromised during Anthropic cybersecurity evaluations disclosed July 2026 y Companies.
Sistemas de IA presuntamente implicados: Python Package Index (PyPI) ecosystem , Large language models , Cybersecurity AI systems , Claude Mythos 5 , Claude y AI agent systems
Estadísticas de incidentes
ID
1628
Cantidad de informes
2
Fecha del Incidente
2026-07-30
Editores
Daniel Atherton
Informes del Incidente
Cronología de Informes
Loading...
SAN FRANCISCO — Anthropic, creadora del chatbot Claude, anunció el jueves que los sistemas de inteligencia artificial que estaba probando hackearon sin ser detectados los sistemas de tres empresas externas a principios de este año.
La revel…
Loading...
Respuesta post-incidente de Anthropic
Tras revisar las transcripciones de nuestras evaluaciones de ciberseguridad, detectamos tres incidentes en los que un modelo de Claude accedió a internet desde dentro o mientras interactuaba con un entorno de evaluación de terceros, y poste…
Variantes
Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?
en revisión
Fecha del Incidente:
2026-07-30
en revisión
Fecha del Incidente:
2026-07-31