Incidente 1629: Según informes, un modelo de investigación antrópica escaneó 9.000 objetivos y comprometió la solicitud de una empresa real durante la evaluación.
Entidades
Ver todas las entidadesEstadísticas de incidentes
Informes del Incidente
Cronología de Informes
SAN FRANCISCO — Anthropic, creadora del chatbot Claude, anunció el jueves que los sistemas de inteligencia artificial que estaba probando hackearon sin ser detectados los sistemas de tres empresas externas a principios de este año.
La revel …
Tras revisar las transcripciones de nuestras evaluaciones de ciberseguridad, detectamos tres incidentes en los que un modelo de Claude accedió a internet desde dentro o mientras interactuaba con un entorno de evaluación de terceros, y poste…
Anthropic anunció hoy que, durante pruebas de seguridad internas, uno de sus modelos Claude creó un paquete Python malicioso y lo subió a PyPI, donde se ejecutó en 15 sistemas reales antes de que las defensas automatizadas del registro lo b…
SAN FRANCISCO, 30 de julio (Reuters) - Anthropic anunció el jueves que algunos de sus modelos de IA Claude habían pirateado los sistemas de tres empresas durante pruebas de ciberseguridad. Esta revelación se produce días después de que su c…
Varios de los modelos de inteligencia artificial de última generación de Anthropic lograron infiltrarse recientemente en los sistemas de tres organizaciones externas, según anunció la startup el jueves. Esta revelación, que sorprende nueve …
Anthropic anunció el jueves que una investigación interna reveló tres incidentes en los que su modelo de IA, Claude, vulneró los sistemas de tres organizaciones mientras realizaba pruebas de ciberseguridad. La investigación y la divulgación…
Anthropic reveló el jueves que sus modelos de IA obtuvieron acceso no autorizado a los sistemas de tres organizaciones distintas, cuyos nombres no se han revelado, durante pruebas de ciberseguridad. La compañía afirma que Claude accedió a i…
Anthropic reveló que los modelos de Claude habían accedido a la infraestructura de producción real de tres organizaciones distintas durante evaluaciones de ciberseguridad que debían ejecutarse en entornos aislados y ficticios. La empresa de…
Anthropic (https://apnews.com/hub/anthropic-pbc) declaró que sus modelos de inteligencia artificial hackearon a otras tres organizaciones durante las pruebas, tan solo unos días después de que OpenAI (https://apnews.com/hub/openai-inc), cre…

La empresa de IA Anthropic afirma haber detectado tres casos en los que sus programas de inteligencia artificial abandonaron los entornos de prueba, accedieron a internet y hackearon empresas reales. Esto ocurre después de que su competidor…
Anthropic ha declarado que sus modelos Claude escaparon de un entorno de pruebas supuestamente aislado y obtuvieron acceso no autorizado a los sistemas de tres organizaciones reales. Si esto les suena familiar, es porque se trata del segund…
Anthropic reveló el jueves que tres de sus modelos Claude obtuvieron acceso no autorizado a los sistemas de producción de tres organizaciones durante pruebas de ciberseguridad; no a servidores de prueba ni a copias de prueba, sino a las máq…
Anthropic afirma haber detectado múltiples casos de acceso no autorizado de modelos Claude a sistemas de otras organizaciones, el último incidente de piratería informática con IA que ha generado preocupación y escepticismo.
En una publicaci…
Esta semana se revelaron nuevos ejemplos de modelos de IA que llevaron a cabo ataques no deseados e involuntarios en internet.
El martes, el Instituto de Seguridad de la IA del Reino Unido (AISI) informó que, durante las recientes pruebas r…
SAN FRANCISCO — Los empleados de OpenAI, la empresa creadora de ChatGPT, no se percataron durante semanas de que sus sistemas de IA habían dado un salto alarmante esta primavera.
En lugar de responder preguntas diseñadas para poner a prueba…
Variantes
Incidentes Similares
Selected by our editors
Did our AI mess up? Flag the unrelated incidents

Biased Sentiment Analysis

Northpointe Risk Models
Incidentes Similares
Selected by our editors
Did our AI mess up? Flag the unrelated incidents

Biased Sentiment Analysis


