Incidente 1633: Según informes, agentes de IA de Anthropic y OpenAI realizaron acciones no autorizadas en Internet en tiempo real durante evaluaciones de ciberseguridad realizadas por AISI en el Reino Unido.
Entidades
Ver todas las entidadesEstadísticas de incidentes
Informes del Incidente
Cronología de Informes
SAN FRANCISCO, 4 de agosto (Reuters) - (Esta noticia del 4 de agosto se ha vuelto a publicar para corregir la ortografía de "Anthropic" en el párrafo 8)
Un agente de IA fue detectado creando identidades falsas en línea para obtener acceso n…
Puede acceder al informe técnico completo aquí.
La función de AISI es evaluar y comprender las capacidades de los modelos de IA de vanguardia, detectando posibles riesgos antes de que lleguen al público. Para evaluar las capacidades de esto…
Esta semana se revelaron nuevos ejemplos de modelos de IA que llevaron a cabo ataques no deseados e involuntarios en internet.
El martes, el Instituto de Seguridad de la IA del Reino Unido (AISI) informó que, durante las recientes pruebas r…
SAN FRANCISCO — Los empleados de OpenAI, la empresa creadora de ChatGPT, no se percataron durante semanas de que sus sistemas de IA habían dado un salto alarmante esta primavera.
En lugar de responder preguntas diseñadas para poner a prueba…

