Skip to Content
logologo
AI Incident Database
Donar
Descubrir
Enviar
  • Bienvenido a la AIID
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Vista espacial
  • Blog
  • Resumen de noticias de IA
  • Incidente aleatorio
  • Registrarse
Descubrir
Enviar
  • Bienvenido a la AIID
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Vista espacial
  • Blog
  • Resumen de noticias de IA
  • Incidente aleatorio
  • Registrarse

Bienvenido a
la base de datos de incidentes de IA

Loading...
Un adolescente planificó con la Inteligencia Artificial matar a sus compañeros de colegio: fue detectado por el FBI y allanado en Quilmes

Incidente 1688: Según informes, un adolescente de Quilmes, Argentina, consultó ChatGPT mientras planeaba un tiroteo escolar contra sus compañeros.

Traducido por IA
“Un adolescente planificó con la Inteligencia Artificial matar a sus compañeros de colegio: fue detectado por el FBI y allanado en Quilmes”Último informe
clarin.com2026-09-12

Un adolescente de 15 años de edad había planificado con la Inteligencia Artificial protagonizar para 2027 un tiroteo en su colegio y matar a sus compañeros, un hecho que gracias a la advertencia del FBI pudo ser desactivado. Además, su domicilio en Quilmes fue allanado, le incautaron elementos relacionados con el posible hecho y citaron a sus padres a la Fiscalía.

La investigación del Departamento Federal de Investigaciones (DFI) de la Policía Federal arrancó el pasado 19 de agosto, después de que el Agregado Jurídico del FBI en la Embajada de los Estados Unidos en Argenti

Leer Más
Loading...
Los hutíes utilizaron IA antrópica para intentar construir misiles balísticos.

Incidente 1687: Según informes, la célula de armas GTG-87001, designada como antrópica y ubicada en el norte de Yemen, utilizó el código Claude para desarrollar software de guiado de misiles.

Traducido por IA
“Los hutíes utilizaron IA antrópica para intentar construir misiles balísticos.”
ft.com2026-09-11

Según Anthropic, militantes yemeníes intentaron utilizar el modelo de IA Claude para desarrollar software de guiado, control y navegación para sus misiles balísticos.

En su informe de inteligencia sobre amenazas, publicado el jueves, Anthropic no mencionó a los hutíes, respaldados por Irán, pero afirmó haber identificado una célula de actores maliciosos con base en el norte de Yemen —gran parte del cual está controlado por los rebeldes hutíes— que gestionaba tres programas de desarrollo de armas.

El estudio subraya los crecientes riesgos de que la IA avanzada caiga en manos equivocadas, dado el rápido avance de esta tecnología.

El mismo informe de Anthropic también sugería que científicos habían intentado en repetidas ocasiones utilizar Claude para investigar armas biológicas.

Los laboratorios de IA estadounidenses, que se encuentran a la vanguardia del desarrollo, se enfrentan a una lucha constante para garantizar que actores no autorizados no puedan utilizarla para atacar a Estados Unidos y sus aliados.

Anthropic indicó que la célula yemení pretendía desarrollar armas, entre ellas un misil balístico multietapa, un misil multivariante y un cohete guiado que utilizaba un ordenador de vuelo comercial, similar al de un teléfono móvil.

“Los atacantes utilizaron Claude Code en lugar de ingenieros de software humanos para desarrollar el software de guiado, navegación y control que dirige y estabiliza un vehículo aéreo”, afirmó Anthropic en su informe.

“Utilizaron Claude para integrar un piloto automático de código abierto en una computadora de vuelo portátil, programando el software de control y estimación de posición, ajustando la configuración de control, ejecutando un proceso de compilación de firmware y realizando una simulación de vuelo”.

Anthropic indicó que sus medidas de seguridad bloquearon “muchas de sus solicitudes, pero no todas”, y añadió que “los atacantes emplearon diversas tácticas para eludir” las medidas.

Lo lograron “ocultando sus objetivos y los productos para los que estaba destinado el software, y dividiendo su trabajo en varias sesiones para que ninguna sesión revelara su verdadera intención”.

Los hutíes, uno de los miembros más influyentes del llamado eje de la resistencia iraní y considerados grupo terrorista por Estados Unidos, lanzaron esta semana una ofensiva relámpago a lo largo de la costa yemení del Mar Rojo, capturando un puerto estratégico y avanzando hacia el estrecho de Bab el-Mandeb, una vía marítima vital para el transporte marítimo internacional.

Esta ofensiva rebelde se produce en un contexto de intensificación de los ataques contra la infraestructura energética de Arabia Saudita y de reavivado la guerra civil yemení, que ya dura más de una década. El avance hutí en Bab el-Mandeb, que conecta el Mar Rojo con el Golfo de Adén y el Océano Índico, contribuyó a que el precio del crudo Brent superara los 105 dólares por barril.

Según analistas, los hutíes, curtidos en combate y que controlan la capital yemení, Saná, y gran parte del norte del país, la zona más poblada de Yemen, han estado desarrollando su capacidad misilística y reciben armamento y tecnología de Irán.

Su avance hacia el estrecho de Bab al-Mandeb ha asestado un duro golpe a Arabia Saudí, que intervino en la guerra civil de Yemen para liderar una coalición árabe contra los hutíes en 2015, y ha fortalecido a Irán en su intento por aumentar los precios de la energía como parte de su conflicto con Estados Unidos.

Los hutíes se habían mantenido en gran medida al margen de la guerra con Irán, con la excepción del lanzamiento de varias andanadas de misiles y drones contra Israel.

Una tregua de 2022 entre Arabia Saudí y el gobierno yemení, respaldada por Riad, se mantuvo vigente hasta julio, cuando los hutíes declararon el bloqueo de los puertos saudíes y comenzaron a atacar petroleros saudíes.

El estrecho de Bab al-Mandeb se ha convertido en una ruta vital para las exportaciones de petróleo saudí desde que Irán restringió el tráfico marítimo a través del estrecho de Ormuz tras el inicio de la guerra entre Estados Unidos e Israel contra Irán en febrero.

Anthropic afirmó que los actores en el norte de Yemen llevaron a cabo un esfuerzo sostenido para desarrollar armas guiadas, incluyendo el uso de Claude para el diseño de software de guiado.

«No tenemos pruebas de que los actores lograran desplegar un dispositivo operativo; sin embargo, sí realizaron una prueba de lanzamiento de un cohete guiado», se indica en el informe. «Esta prueba de campo parece haber fracasado: pocas horas después, los actores regresaron a Claude para investigar el motivo del fallo».

Anthropic declinó comentar si los «actores de la amenaza con base en el norte de Yemen» eran efectivamente los hutíes, pero pocos otros grupos se ajustan a esa descripción.

La empresa de IA afirmó haber bloqueado las cuentas asociadas con los actores y haber compartido información sobre la amenaza con socios de los sectores público y privado para mitigar los riesgos que estos representan.

«No obstante, tenemos pruebas de que los actores ya habían desarrollado un conjunto de herramientas de simulación sin conexión que no depende de Claude ni de otros entornos informáticos de ingeniería», se indica.

Información adicional de Madhumita Murgia

Leer Más
Loading...
Antes del lanzamiento de su Cybercab, Tesla le dijo a una familia afligida que los datos del accidente fatal de un automóvil autónomo se habían perdido; un hacker demostró que cada automóvil guarda sus datos.

Incidente 1686: Según los informes, un Tesla Model S con el piloto automático activado chocó contra una camioneta estacionada en Key Largo, causando la muerte de una persona e hiriendo gravemente a otra que se encontraba cerca.

Traducido por IA
“Antes del lanzamiento de su Cybercab, Tesla le dijo a una familia afligida que los datos del accidente fatal de un automóvil autónomo se habían perdido; un hacker demostró que cada automóvil guarda sus datos.”
moneywise.com2026-09-10

Elon Musk planea lanzar próximamente los Cybercabs, vehículos totalmente autónomos sin control humano, vehículos que no requieren intervención humana. Sin embargo, una demanda que se cerró este año indica que la compañía de autos eléctricos podría no estar lista para el lanzamiento.

En marzo de 2024, Neima Benavides y Dillon Angulo interpusieron una demanda contra Tesla después de que un Tesla autónomo chocara contra el coche aparcado de Angulo y Naibel Benavides Leon, causando la muerte de Benavides Leon e hiriendo gravemente a Angulo. En agosto de 2025, un jurado dictaminó que Tesla era parcialmente responsable y, en febrero de 2026, un juez desestimó la apelación de Tesla.

Tesla tuvo que pagar 243 millones de dólares en concepto de indemnización. Además, cambió el nombre de sus funciones de piloto automático y conducción autónoma para dejar claro que los conductores no deberían dejar que sus coches conduzcan sin supervisión.

Sin embargo, la compañía podría haber evitado la condena por completo de no ser por una prueba clave. Aquí te contamos cómo salió a la luz esa prueba y qué nos revela la demanda sobre el próximo lanzamiento de los taxis virtuales de Musk.

Un hacker ruso convirtió un trabajo relacionado con una vulnerabilidad de software de Tesla en una indemnización de 243 millones de dólares para la familia de la víctima.

Como parte de la demanda, se solicitó al jurado que determinara qué porcentaje del fatal accidente de Angulo y Benavides León fue culpa de Tesla y qué porcentaje fue culpa del conductor.

En teoría, el Autopilot de Tesla registra datos del accidente que facilitarían la determinación de la responsabilidad. El Autopilot está diseñado para enviar un video de los cinco segundos previos a cualquier accidente directamente a la sede de Tesla si el vehículo sufre un siniestro.

Tesla afirmó no tener dicho video.

«Los datos transmitidos a Tesla no incluyen ni el vídeo del accidente ni las instantáneas», declaró Thomas Branigan, asesor externo de Tesla, en una carta dirigida al abogado del demandante. «Tesla no puede proporcionar un vídeo "aumentado"».

Aquí es donde entra en escena el hacker, conocido por su nombre de usuario @greentheonly. Este hacker trabajaba para Tesla a través de su programa de recompensas por detección de errores (Bug Bounty), informando sobre vulnerabilidades de software a cambio de una recompensa de 15.000 dólares. Logró recuperar los datos del accidente y demostrar que Tesla sí tenía acceso a ellos, algo que, según alega, Tesla sabía, informó el Washington Post.

«Para cualquier persona razonable, era obvio que los datos estaban ahí», declaró Green al Washington Post.

También afirmó que Tesla ha reforzado la seguridad de los datos de accidentes de vehículos desde entonces.

«Si ocurriera un accidente como este hoy, no podría extraer los datos», dijo en su entrevista con el Washington Post.

Los Tesla autónomos siguen sufriendo accidentes de gran repercusión.

Los Tesla autónomos siguen sufriendo accidentes. Tesla y la Administración Nacional de Seguridad del Tráfico en las Carreteras (NHTSA) informaron que los Tesla con sistemas activos de asistencia al conductor se vieron involucrados en 207 accidentes en mayo, la cifra más alta registrada hasta la fecha.

Este mismo mes, el entrenador de los San Francisco 49ers, Kyle Shanahan, resultó herido en un accidente con un Tesla que, según él, estaba en modo de piloto automático. Su coche se desvió hacia el carril contrario a baja velocidad cuando giró para sacar su teléfono del asiento trasero.

"Quién sabe qué pasó cuando giré", dijo Shanahan en una rueda de prensa. "Si falló el sistema o si lo golpeé. Eso es algo que aún no sé".

En marzo, la NHTSA elevó la investigación en curso sobre la compañía automotriz en relación con accidentes potencialmente causados por fallas en el software de conducción autónoma.

Esto no significa que los Cybercabs de Tesla estén condenados al fracaso. Sin embargo, dadas las preocupaciones sobre el rendimiento del AutoPilot de los autos Tesla —y su falta de transparencia respecto a estos accidentes, incluyendo la supuesta manipulación de datos para que sus autos parezcan más seguros—, conviene ser cautelosos ante el despliegue de robotaxis totalmente autónomos.

Tesla no respondió de inmediato a la solicitud de comentarios de Moneywise.

Leer Más
Loading...
Vídeos pornográficos con deepfake conmocionan a los medios de comunicación: celebridades y políticos presentan denuncias.

Incidente 1684: Decenas de mujeres holandesas, entre ellas políticas y figuras públicas, fueron presuntamente blanco de pornografía deepfake manipulada con IA.

Traducido por IA
“Vídeos pornográficos con deepfake conmocionan a los medios de comunicación: celebridades y políticos presentan denuncias.”
ad.nl2026-09-10

Las agencias de gestión y las autoridades están intentando que las imágenes sean retiradas de internet. El partido D66 solicita un debate. La Autoridad de Protección de Datos de los Países Bajos insta a las víctimas a acudir a la Fiscalía.

La ministra interina de Justicia, Dilan Yesilgöz, también insta a las víctimas a presentar una denuncia. «¡Es repugnante y, además, un delito! ¡Por favor, denuncien!», responde en X. La ministra señala que las víctimas están aún mejor protegidas por la Ley de Delitos Sexuales, que defenderá en el Senado el martes. «¡Hay que combatir este tipo de prácticas viles! Si eres víctima y necesitas ayuda, puedes acudir a helpwanted.nl».

Deepfake

El diputado del D66, Joost Sneller, afirma en X que ha solicitado un debate sobre los llamados deepfakes. «Estas empresas y creadores no deben eludir su responsabilidad, y las personas deben ser protegidas eliminando el contenido lo antes posible». Desconcertados

Ante los vídeos explícitos, la mayoría de las víctimas reaccionan con desconcierto. Muchas acuden a la policía para denunciar, entre ellas la alcaldesa Sharon Dijksma (Utrecht), la ex portavoz de la policía Ellie Lust, varios cantantes y presentadores, y partidos como BBB, el Partido por los Animales y D66. GroenLinks-PvdA y la VVD también están investigando acciones legales, ya que sus políticos aparecen en los vídeos. «Crear y distribuir este tipo de imágenes es vil, ofensivo y, además, un delito», declara la VVD. La Cámara de Representantes habla de «prácticas repugnantes» y apoya a los diputados en la presentación de sus denuncias.

¿Qué tipo de vídeos deepfake están implicados?


Los llamados deepfakes crean una realidad falsa que daña vidas. Mediante tecnología de IA, quienes suben los vídeos superponen el rostro de una persona famosa sobre el de una actriz porno mientras esta mantiene relaciones sexuales consigo misma o con un hombre. Cualquiera que busque deliberadamente este material pronto terminará en Platform S*, un sitio que atrae a 13 millones de visitantes mensuales y cuenta con una enorme base de datos de videos protagonizados por celebridades neerlandesas, desde artistas y presentadores de NOS, SBS6 y ESPN, hasta atletas olímpicos, exministros, alcaldes y miembros de la Familia Real.

El grupo detrás de Platform S, fundado en 2018, opera en secreto. Se recomienda a quienes suben videos que permanezcan siempre anónimos, presumiblemente para evitar ser procesados. Cuanto mejor sea la puntuación de un video, mayor será la remuneración. Algunos videos, con títulos explícitos como "La persona A se corre" o "La persona B es follada por...", ya han sido vistos más de 100.000 veces. Debajo de los videos, los espectadores animan a quienes los suben y ofrecen consejos para futuras víctimas. "Seguro que quieres más de esto" y "¡Deberías probar (...) después!" se pueden leer, entre otras cosas. Sin la intervención del gobierno, todos serán blanco de ataques, predicen los expertos en ciberseguridad. Las víctimas no reciben la ayuda suficiente debido a la falta de una legislación adecuada, advierte el abogado especializado en tecnología Jelle Wieringa. Como resultado, el número de vídeos protagonizados por celebridades neerlandesas sigue aumentando. Hace apenas unas semanas, por ejemplo, apareció en internet un nuevo vídeo de un exministro. "Ya es hora de que esto reciba una amplia cobertura mediática, porque la situación está empeorando", afirma la presentadora de SBS6, Sylvana IJsselmuiden, una de las víctimas. Su vídeo ya ha sido visto casi 20.000 veces. Está considerando presentar una denuncia ante la policía. "Ya he intentado que lo retiren".

Su reacción no es un caso aislado. La destacada figura de SBS6, Hélène Hendriks, también está trabajando discretamente para que se elimine el vídeo. Los representantes de Leontine Ruiters, la presentadora de SBS Noa Vahle, la actriz Jennifer Hoffman, Olcay Gulsen y la cantante Simone Simons también están explorando sus opciones legales. Un exconcursante del Festival de Eurovisión y un senador afirman que presentarán una denuncia policial de todos modos, con la esperanza de que los vídeos sean retirados de internet lo antes posible. La agencia de representación A Million Faces también considera "extraño" que "varios de sus artistas" aparezcan en los vídeos y está estudiando otras medidas.

¿Qué pueden hacer las víctimas?


El deepfake se considera porno vengativo, un delito penal. Legalmente, existen varias vías legales. Las víctimas pueden presentar una denuncia policial, lo que puede dar lugar a una investigación por parte de la fiscalía. Con la aprobación del juez de instrucción, la Fiscalía puede intentar cerrar el sitio web. Esto solo es posible si los delitos cometidos justifican la detención, explica la Fiscalía. En la práctica, su retirada depende de varios factores, como la ubicación de los servidores que alojan el sitio.

Esto resulta difícil en el caso de Platform S. El sitio está registrado en Charlestown, la capital de la isla caribeña de San Cristóbal y Nieves, junto a Sint Eustatius. Probablemente con razón, ya que esto dificulta considerablemente el enjuiciamiento, según afirma Arnoud Engelfriet, experto en informática de la consultora ICTRecht. Otra opción es localizar a los propios responsables de las subidas. Esto es posible si la policía emite una orden para la entrega de direcciones IP y Platform S la acata. Sin embargo, esto último requiere la cooperación de la policía local, lo cual, por lo tanto, es complicado.

![](data:image/svg+xml;base64,PHN2ZyB4bWxucz0iaHR0cDovL3d3dy53My5vcmcvMjAwMC9zdmciIHdpZHRoPSI2NCIgaGVpZ2h0PSI2NCIgd mlld0JveD0iMCAwIDY0IDY0IiBjbGFzcz0iaWNvbnMiPjx0aXRsZT5RdW90ZTwvdGl0bGU+PHBhdGggZD0iTTE2LjEgNS4zSDQuMkMuNCA5LjIgMCAxN i40IDAgMjIuN3YzNS42aDI5LjRWMjIuN0gxMi45Yy4zLTExLjEgMy4yLTE3LjQgMy4yLTE3LjR6TTQ3LjUgMjMuMWMuMy0xMS4xIDMuMS0xNy40IDM uMS0xNy40SDM4LjhjLTMuOSAzLjktNC4yIDExLjEtNC4yIDE3LjR2MzUuNkg2NFYyMy4xSDQ3LjV6IiBmaWxsPSIjZDEwYTEwIi8+PC9zdmc+Cg==)

Si yo fuera víctima, escribiría al editor, al proveedor y al titular del nombre de dominio y los amenazaría con la condenación eterna.

-Abogado tecnológico Jan Gerrit Kroon

Reclamación colectiva

Otra opción es iniciar una demanda colectiva. Existen mecanismos de denuncia colectiva, como fundaciones donde las víctimas se unen. El abogado Richard Korver, presidente de la fundación LANZGS, que cuenta con defensores especializados en víctimas, indica que las víctimas harían bien en presentar una denuncia policial. Además, pueden presentar una queja ante la Autoridad Neerlandesa de Protección de Datos por violación de la privacidad. Finalmente, las partes afectadas pueden contactar con los proveedores de alojamiento web. «Tienen políticas que les obligan a intervenir en actividades ilegales en los sitios web que alojan», explica el abogado especializado en tecnología Jan Gerrit Kroon.

Por lo tanto, la acusación tiene posibilidades de éxito. Por ejemplo, el año pasado, el creador de los vídeos deepfake del presentador de WNL, Welmoed Sijtsma, fue condenado a realizar trabajos comunitarios. Esta condena no pasó desapercibida entre los aficionados a los deepfakes. Uno de los usuarios más populares se hace llamar, en tono de broma, «Welmoed Sijtsma». Su perfil incluye más de 120 vídeos manipulados, en los que se explota a un número considerable de políticos. Sijtsma, quien anteriormente realizó una serie documental sobre el mundo de los deepfakes, desconocía esto y lo califica de «extraño».

![](data:image/svg+xml;base64,PHN2ZyB4bWxucz0iaHR0cDovL3d3dy53My5vcmcvMjAwMC9zdmciIHdpZHRoPSI2NCIgaGVpZ2h0PSI2NCIgd mlld0JveD0iMCAwIDY0IDY0IiBjbGFzcz0iaWNvbnMiPjx0aXRsZT5RdW90ZTwvdGl0bGU+PHBhdGggZD0iTTE2LjEgNS4zSDQuMkMuNCA5LjIgMCAxN i40IDAgMjIuN3YzNS42aDI5LjRWMjIuN0gxMi45Yy4zLTExLjEgMy4yLTE3LjQgMy4yLTE3LjR6TTQ3LjUgMjMuMWMuMy0xMS4xIDMuMS0xNy40IDM uMS0xNy40SDM4LjhjLTMuOSAzLjktNC4yIDExLjEtNC4yIDE3LjR2MzUuNkg2NFYyMy4xSDQ3LjV6IiBmaWxsPSIjZDEwYTEwIi8+PC9zdmc+Cg==)

Actualmente no existe una policía de deepfakes, por lo que las víctimas realmente tienen que defenderse.

-Henk van Ess, experto en IA

«Amenaza con el infierno y la condenación»

Sea cual sea el camino que elijas: Por favor, no lo dejen pasar, aconsejan los expertos legales. "Si yo fuera víctima, escribiría al editor, al proveedor y al titular del dominio y los amenazaría con las consecuencias", aconseja el abogado especializado en tecnología Jan Gerrit Kroon. Actualmente no existe una policía contra los deepfakes, por lo que las víctimas realmente tienen que defenderse, afirma el experto en IA Henk van Ess. "Las víctimas deben mantener alerta a las fuerzas del orden y a los legisladores, y sin duda, seguir presentando denuncias".

Los vídeos caseros en la Plataforma S suelen durar unos minutos y, a veces, enlazan con vídeos aún más largos que se ofrecen por un precio en otro sitio web, al que llamaremos Plataforma B para simplificar. Cabe destacar que, según NBC, los pagos en ese sitio son gestionados por un proveedor de servicios neerlandés llamado Verotel, con sede en Ámsterdam. Un empleado que hablaba inglés se negó a comentar las quejas de las celebridades neerlandesas y colgó el teléfono.

Un día después de esta publicación, Verotel finalmente ofreció información completa mediante un comunicado de prensa enviado por correo electrónico por su director ejecutivo, Joost Zuurbier. Se afirma que la colaboración con la Plataforma B se interrumpió en marzo de 2023 porque, supuestamente, la plataforma (similar a OnlyFans) no cumplía con las "estrictas normas". Verotel desea recalcar que nunca estuvo directamente involucrada con la Plataforma S. El proveedor de servicios con sede en Ámsterdam declara que condena enérgicamente la creación y distribución de vídeos deepfake.

"Es una fantasía"

Cabe mencionar que ya existen sitios web pornográficos que prohíben activamente los deepfakes en sus plataformas. Cualquier persona que busque este tipo de material en Pornhub, por ejemplo, recibe un aviso de que el término de búsqueda contiene "material sexual ilegal y abusivo" para el cual no se ha dado consentimiento. Pornhub advierte que la distribución de este tipo de vídeos conlleva sanciones. Sin embargo, otro sitio web popular sí ofrece cientos de fotos deepfake de más de 200 celebridades neerlandesas, incluyendo modelos y youtubers populares.

Mientras tanto, el propietario estadounidense anónimo de la Plataforma S afirma desconocer cualquier irregularidad. «Mientras te convenzas de que no es del todo real, no importa demasiado», afirma en una inusual entrevista con la BBC. «No creo que se necesite permiso para esto. Es una fantasía, no es real». El propietario no respondió a las preguntas de este sitio web.

*Aviso legal: Para este artículo, se entrevistó a decenas de víctimas y sus portavoces, organizaciones, partidos políticos y directivos. Todas las partes involucradas revisaron el artículo con antelación y dieron su consentimiento para su publicación. AD entiende que mencionar nombres puede tener consecuencias negativas. El objetivo de este artículo es concienciar y sacar a la luz los delitos. «Plataforma S» no es el nombre correcto del sitio web de deepfakes mencionado. Esto se hizo deliberadamente para proteger a las víctimas.

Leer Más
Loading...
Anthropic revela un cuarto incidente de piratería informática de IA que no se incluyó en una revisión anterior.

Incidente 1685: Según informes, una versión temprana de Claude Opus 4.6 Checkpoint obtuvo acceso administrativo no autorizado a un sistema de terceros durante una evaluación de ciberseguridad.

Traducido por IA
“Anthropic revela un cuarto incidente de piratería informática de IA que no se incluyó en una revisión anterior.”
reuters.com2026-09-10

Anthropic reveló el miércoles otro caso de un modelo de IA que pirateó sistemas externos durante las pruebas, el último de una creciente lista de incidentes que han generado preocupación sobre el riesgo que representan los agentes de IA autónomos.

El incidente de enero pasó desapercibido hasta el mes pasado, a pesar de una revisión previa en toda la empresa, según Anthropic, lo que subraya el desafío que enfrentan los desarrolladores de IA para identificar y contener comportamientos inesperados de modelos avanzados.

La compañía indicó en una publicación de blog que el incidente involucró una versión temprana de Claude Opus 4.6. Añadió que había notificado a todas las partes afectadas, pero no reveló más detalles. Empresas como Anthropic y OpenAI están bajo escrutinio, ya que los modelos diseñados para completar tareas complejas a veces han aprendido a eludir las reglas, explotar vulnerabilidades e interactuar con sistemas externos de maneras que sus desarrolladores no anticiparon.

Reuters informó la semana pasada que agentes malintencionados de OpenAI secuestraron una wiki en alemán y muchos otros sitios web; un incidente que OpenAI optó por no revelar hasta que la agencia de noticias lo hizo público.

La revelación de Anthropic se produce tras su anuncio en julio de que algunos de sus modelos Claude habían hackeado los sistemas de tres empresas durante pruebas de ciberseguridad.

Los incidentes anteriores, que la empresa calificó como un "fallo operativo", involucraron a tres modelos distintos: Claude Opus 4.7, Claude Mythos 5 y un modelo interno de prueba para investigación.

Los incidentes se originaron por un error que, sin querer, otorgó a los modelos acceso a internet.

La empresa identificó los incidentes tras revisar 141.006 sesiones de prueba, un proceso que inició después de que un agente autónomo, impulsado por modelos de IA de OpenAI, provocara un ataque que comprometió la infraestructura de la startup de IA Hugging Face.

Anthropic declaró el miércoles que había omitido un conjunto de sesiones de prueba durante la revisión inicial, las cuales fueron identificadas el mes pasado y llevaron al descubrimiento del cuarto incidente.

Según una evaluación preliminar, Anthropic afirmó no creer que el último incidente fuera más grave que los tres anteriores, que ya han sido examinados en detalle.

La empresa afirmó que su investigación identificó dos problemas recurrentes, que se manifestaron en distintos grados en los diversos incidentes: un razonamiento sesgado, en el que Claude desestimó o malinterpretó la evidencia de que operaba en internet en tiempo real, y la imprudencia, es decir, la disposición a realizar acciones potencialmente dañinas para lograr un objetivo.

Anthropic indicó que contrató a la firma de investigación independiente METR para investigar los incidentes. Añadió que METR tendría amplio acceso, incluyendo transcripciones de fuera del período en que ocurrieron los incidentes y a los empleados, quienes estarían autorizados a compartir información confidencial.

METR elaboró ​​un informe de 91 páginas sobre el hackeo de OpenAI-Hugging Face basado en un acceso parcial, pero no completo, a los datos de la empresa, y concluyó, junto con una investigación independiente de Redwood Research, que aproximadamente 700 agentes de IA actuaron en un enjambre coordinado durante la brecha y a menudo intentaron ocultar sus huellas.

Leer Más
Acerca de la Base de Datos

La base de datos de incidentes de IA está dedicada a indexar el historial colectivo de daños o casi daños realizados en el mundo real por el despliegue de sistemas de inteligencia artificial. Al igual que bases de datos similares en aviación y seguridad informática, la base de datos de incidentes de IA tiene como objetivo aprender de la experiencia para que podamos prevenir o mitigar los malos resultados.

Estás invitado a enviar informes de incidentes, después de lo cual los envíos se indexarán y se harán visibles para el mundo. La inteligencia artificial solo será un beneficio para las personas y la sociedad si registramos colectivamente y aprendemos de sus fallas. (Más información)

post-image
Investigación de incidentes de IA para construir un futuro más seguro: el Instituto de Investigación de Seguridad Digital se asocia con Responsible AI Collaborative

By TheCollab Board of Directors

2024-02-20

El Instituto de Investigación de Seguridad Digital (DSRI) de los Institutos de Investigación de UL se está asociando con Responsible AI Coll...

Leer Más
La Base de Datos en la Prensa

Lea acerca de la base de datos en Time Magazine, Vice News, Venture Beat, Wired y Bulletin of the Atomic Scientists entre otros puntos de venta.

Arxiv LogoVenture Beat LogoWired LogoVice logoNewsweek logoTime logoBulletin of the Atomic Scientists logoStanford HAI logoRolling Stone logoThe Guardian logoHarvard Business Review logoBrasil em Folhas logo
El Colaborativo de IA Responsable

La base de datos de incidentes de IA es un proyecto de Responsible AI Collaborative, una organización autorizada para promover la base de datos de incidentes de IA. La gobernanza de la Colaborativa se estructura en torno a la participación en su programación de impacto. Para obtener más detalles, lo invitamos a leer el informe de fundación y obtener más información sobre nuestro and learn more on our.

View the Responsible AI Collaborative's Form 990 and tax-exempt application. We kindly request your financial support with a donation.

Patrocinador fundador de la organización
Patrocinador fundador de la base de datos
Patrocinadores y subvenciones
Patrocinadores similares
El Informe de Incidentes de IA
An envelope with a neural net diagram on its left

Create an account to subscribe to new incident notifications and other updates.

Investigación

  • Definición de un “Incidente de IA”
  • Definición de una “Respuesta a incidentes de IA”
  • Hoja de ruta de la base de datos
  • Trabajo relacionado
  • Descargar Base de Datos Completa

Proyecto y Comunidad

  • Acerca de
  • Contactar y Seguir
  • Aplicaciones y resúmenes
  • Guía del editor

Incidencias

  • Todos los incidentes en forma de lista
  • Incidentes marcados
  • Cola de envío
  • Vista de clasificaciones
  • Taxonomías

2026 - AI Incident Database

  • Condiciones de uso
  • Política de privacidad
  • dd3f754