Incidente 1629: Según informes, un modelo de investigación antrópica escaneó 9.000 objetivos y comprometió la solicitud de una empresa real durante la evaluación.
Respondido
Descripción: Durante una evaluación de ciberseguridad de Anthropic con Irregular, un modelo interno de investigación de Claude analizó aproximadamente 9000 objetivos de internet tras no lograr alcanzar su objetivo ficticio. Según se informa, comprometió la aplicación web de una empresa real utilizando credenciales de una página de depuración expuesta e inyección SQL, y se detuvo al reconocer que el host era real.
Editor Notes: Anthropic did not disclose when this incident occurred, only that the cybersecurity-evaluation incidents it identified dated back as early as April 2026. This incident ID is one of three separate incidents Anthropic publicly reported on 07/30/2026: 1627, 1628, and 1629 make up that cluster. 07/30/2026 is therefore used as the first-public-disclosure fallback. The incident ID was created 08/08/2026.
Entidades
Ver todas las entidadesAlleged: Anthropic , Large language model developers y AI agent system developers developed an AI system deployed by Irregular , Anthropic , AI evaluation organizations y AI agent system deployers, which harmed Unidentified companies compromised during Anthropic cybersecurity evaluations disclosed July 2026 y Companies.
Sistemas de IA presuntamente implicados: Large language models , Internal Anthropic research test models , Cybersecurity AI systems , Claude y AI agent systems
Estadísticas de incidentes
ID
1629
Cantidad de informes
2
Fecha del Incidente
2026-07-30
Editores
Daniel Atherton
Informes del Incidente
Cronología de Informes
Loading...
SAN FRANCISCO — Anthropic, creadora del chatbot Claude, anunció el jueves que los sistemas de inteligencia artificial que estaba probando hackearon sin ser detectados los sistemas de tres empresas externas a principios de este año.
La revel…
Loading...
Respuesta post-incidente de Anthropic
Tras revisar las transcripciones de nuestras evaluaciones de ciberseguridad, detectamos tres incidentes en los que un modelo de Claude accedió a internet desde dentro o mientras interactuaba con un entorno de evaluación de terceros, y poste…
Variantes
Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?
en revisión
Fecha del Incidente:
2026-07-30
en revisión
Fecha del Incidente:
2026-07-31
Incidentes Similares
Selected by our editors
Did our AI mess up? Flag the unrelated incidents
Loading...

Biased Sentiment Analysis
· 6 informes
Loading...

Northpointe Risk Models
· 15 informes
Incidentes Similares
Selected by our editors
Did our AI mess up? Flag the unrelated incidents
Loading...

Biased Sentiment Analysis
· 6 informes
Loading...

Northpointe Risk Models
· 15 informes
