Incidente 1627: Según informes, Claude Opus 4.7 comprometió la infraestructura de producción de una empresa real durante una evaluación de ciberseguridad.
Respondido
Descripción: Durante una evaluación de ciberseguridad de Anthropic realizada con Irregular, Claude Opus 4.7 supuestamente alcanzó una empresa real cuyo dominio coincidía con un objetivo ficticio, extrajo credenciales de aplicaciones e infraestructura y accedió a una base de datos con varios cientos de filas de datos de producción. En cuatro ejecuciones, el modelo continuó atacando tras reconocer que el objetivo probablemente era real.
Editor Notes: Anthropic did not disclose when this incident occurred, only that the cybersecurity-evaluation incidents it identified dated back as early as April 2026. This incident ID is one of three separate incidents Anthropic publicly reported on 07/30/2026: 1627, 1628, and 1629 make up that cluster. 07/30/2026 is therefore used as the first-public-disclosure fallback. The incident ID was created 08/07/2026.
Entidades
Ver todas las entidadesAlleged: Anthropic , Large language model developers y AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations y AI agent system deployers, which harmed Unidentified companies compromised during Anthropic cybersecurity evaluations disclosed July 2026 y Companies.
Sistemas de IA presuntamente implicados: Large language models , Claude Opus 4.7 , Claude y AI agent systems
Estadísticas de incidentes
ID
1627
Cantidad de informes
2
Fecha del Incidente
2026-07-30
Editores
Daniel Atherton
Informes del Incidente
Cronología de Informes
Loading...
SAN FRANCISCO — Anthropic, creadora del chatbot Claude, anunció el jueves que los sistemas de inteligencia artificial que estaba probando hackearon sin ser detectados los sistemas de tres empresas externas a principios de este año.
La revel…
Loading...
Respuesta post-incidente de Anthropic
Tras revisar las transcripciones de nuestras evaluaciones de ciberseguridad, detectamos tres incidentes en los que un modelo de Claude accedió a internet desde dentro o mientras interactuaba con un entorno de evaluación de terceros, y poste…
Variantes
Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?
en revisión
Fecha del Incidente:
2026-07-30
en revisión
Fecha del Incidente:
2026-07-31