Incidente 956: La supuesta inclusión de 12.000 claves API activas en los datos de formación LLM plantea riesgos de seguridad.

Descripción:

Un conjunto de datos utilizado para entrenar grandes modelos de lenguaje supuestamente contenía 12 000 claves API y credenciales de autenticación activas. Algunas de ellas, según se informa, seguían activas y permitían accesos no autorizados. Truffle Security encontró estos secretos en un archivo de Common Crawl de diciembre de 2024, que abarca 250 000 millones de páginas web. Las credenciales afectadas podrían haber sido explotadas para accesos no autorizados a datos, interrupciones del servicio, fraude financiero y otros usos maliciosos.

Herramientas

Nuevo Informe Nueva Respuesta DescubrirVer Historial

Entidades

Ver todas las entidades

Alleged: Microsoft , OpenAI y Common Crawl developed an AI system deployed by Microsoft , OpenAI , Common Crawl y Microsoft Azure OpenAI Service, which harmed Microsoft , AWS , Slack , Mailchimp , Google , Intel , Huawei , PayPal , IBM y Tencent.

Sistemas de IA presuntamente implicados: Common Crawl dataset (December 2024 archive) , Microsoft Copilot , Google Gemini , Anthropic Claude , ChatGPT , xAI Grok , DeepSeek y LLMs trained on compromised data

Estadísticas de incidentes

956

Cantidad de informes

Fecha del Incidente

2025-02-28

Editores

Daniel Atherton

Applied Taxonomies

MIT

Clasificaciones de la Taxonomía MIT

Machine-Classified

Detalles de la Taxonomía

Risk Subdomain

2.1. Compromise of privacy by obtaining, leaking or correctly inferring sensitive information

Risk Domain

Privacy & Security

Entity

Human

Timing

Pre-deployment

Intent

Unintentional

Informes del Incidente

Cronología de Informes

Se encontraron más de 12 000 claves API y contraseñas en conjuntos de datos públicos utilizados para la capacitación LLM

thehackernews.com

thehackernews.com · 2025

Traducido por IA

Se ha descubierto que un conjunto de datos utilizado para entrenar modelos de lenguaje grandes (LLM) contiene casi 12 000 secretos activos, que permiten una autenticación exitosa.

Los hallazgos resaltan una vez más cómo las credenciales cod…

Variantes

Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.

¿Has visto algo similar?

Incidentes Similares

Por similitud de texto

Did our AI mess up? Flag the unrelated incidents

Incidentes Similares

Por similitud de texto

Did our AI mess up? Flag the unrelated incidents

Incidente 956: La supuesta inclusión de 12.000 claves API activas en los datos de formación LLM plantea riesgos de seguridad.

Herramientas

Entidades

Estadísticas de incidentes

Clasificaciones de la Taxonomía MIT

Informes del Incidente

Cronología de Informes

Se encontraron más de 12 000 claves API y contraseñas en conjuntos de datos públicos utilizados para la capacitación LLM

Se encontraron más de 12 000 claves API y contraseñas en conjuntos de datos públicos utilizados para la capacitación LLM

Variantes

Incidentes Similares

Por similitud de texto

Biased Sentiment Analysis

Wikipedia Vandalism Prevention Bot Loop

Fake LinkedIn Profiles Created Using GAN Photos

Incidentes Similares

Por similitud de texto

Biased Sentiment Analysis

Wikipedia Vandalism Prevention Bot Loop

Fake LinkedIn Profiles Created Using GAN Photos