Incidente 1633: Según informes, agentes de IA de Anthropic y OpenAI realizaron acciones no autorizadas en Internet en tiempo real durante evaluaciones de ciberseguridad realizadas por AISI en el Reino Unido.
Descripción: A partir del 26 de julio de 2026, agentes de IA impulsados por Mythos 5 de Anthropic y GPT-5.6 Sol de OpenAI realizaron, según informes, 19 acciones no autorizadas en internet durante las evaluaciones de ciberseguridad de AISI en el Reino Unido. Se informó que Mythos 5 fue responsable de 17 incidentes, muchos de los cuales supuestamente implicaban intentos engañosos de manipular a desarrolladores reales para que aceptaran código malicioso. Según los informes, AISI detectó y contuvo la actividad; no se identificó ningún daño real resultante.
Editor Notes: The full technical report published by the UK AISI can be accessed at the following URL: https://cdn.prod.website-files.com/663bd486c5e4c81588db7a1d/6a724858f7db25c81487016d_Security%20Incident%20INC-2026-07-28-01.pdf.
Entidades
Ver todas las entidadesAlleged: OpenAI , Large language model developers , Anthropic y AI agent system developers developed an AI system deployed by Government agencies , AI Security Institute (United Kingdom) , AI evaluation organizations y AI agent system deployers, which harmed Software developers , Open-source maintainers y GitHub users.
Sistemas de IA presuntamente implicados: Supply chains , Software ecosystems , Large language models , GPT-5.6 Sol , GitHub repositories , GitHub , Claude Mythos 5 , Claude y AI agent systems
Estadísticas de incidentes
ID
1633
Cantidad de informes
2
Fecha del Incidente
2026-07-26
Editores
Daniel Atherton
Informes del Incidente
Cronología de Informes
Loading...
SAN FRANCISCO, 4 de agosto (Reuters) - (Esta noticia del 4 de agosto se ha vuelto a publicar para corregir la ortografía de "Anthropic" en el párrafo 8)
Un agente de IA fue detectado creando identidades falsas en línea para obtener acceso n…
Loading...
Puede acceder al informe técnico completo aquí.
La función de AISI es evaluar y comprender las capacidades de los modelos de IA de vanguardia, detectando posibles riesgos antes de que lleguen al público. Para evaluar las capacidades de esto…
Variantes
Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?
Incidentes Similares
Selected by our editors
OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation
· 5 informes
Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation
· 13 informes
Did our AI mess up? Flag the unrelated incidents
Incidentes Similares
Selected by our editors
OpenAI Models Reportedly Compromised Hugging Face Production Infrastructure During Cybersecurity Evaluation
· 5 informes
Claude Opus 4.7 Reportedly Compromised Real Company's Production Infrastructure During Cybersecurity Evaluation
· 13 informes
Did our AI mess up? Flag the unrelated incidents

