Incidente 956: translated-es-Alleged Inclusion of 12,000 Live API Keys in LLM Training Data Reportedly Poses Security Risks
Descripción: translated-es-A dataset used to train large language models allegedly contained 12,000 live API keys and authentication credentials. Some of these were reportedly still active and allowed unauthorized access. Truffle Security found these secrets in a December 2024 Common Crawl archive, which spans 250 billion web pages. The affected credentials could have been exploited for unauthorized data access, service disruptions, financial fraud, and a variety of other malicious uses.
Entidades
Ver todas las entidadesAlleged: Microsoft , OpenAI y Common Crawl developed an AI system deployed by Microsoft , OpenAI , Common Crawl y Microsoft Azure OpenAI Service, which harmed Microsoft , AWS , Slack , Mailchimp , Google , Intel , Huawei , PayPal , IBM y Tencent.
Sistemas de IA presuntamente implicados: Common Crawl dataset (December 2024 archive) , Microsoft Copilot , Google Gemini , Anthropic Claude , ChatGPT , xAI Grok , DeepSeek y LLMs trained on compromised data
Estadísticas de incidentes
ID
956
Cantidad de informes
1
Fecha del Incidente
2025-02-28
Editores
Dummy Dummy
Informes del Incidente
Cronología de Informes
Se ha descubierto que un conjunto de datos utilizado para entrenar modelos de lenguaje grandes (LLM) contiene casi 12 000 secretos activos, que permiten una autenticación exitosa.
Los hallazgos resaltan una vez más cómo las credenciales cod…
Variantes
Una "Variante" es un incidente de IA similar a un caso conocido—tiene los mismos causantes, daños y sistema de IA. En lugar de enumerarlo por separado, lo agrupamos bajo el primer incidente informado. A diferencia de otros incidentes, las variantes no necesitan haber sido informadas fuera de la AIID. Obtenga más información del trabajo de investigación.
¿Has visto algo similar?
Incidentes Similares
Did our AI mess up? Flag the unrelated incidents

Biased Sentiment Analysis
· 7 informes

Wikipedia Vandalism Prevention Bot Loop
· 6 informes

Fake LinkedIn Profiles Created Using GAN Photos
· 4 informes
Incidentes Similares
Did our AI mess up? Flag the unrelated incidents

Biased Sentiment Analysis
· 7 informes

Wikipedia Vandalism Prevention Bot Loop
· 6 informes

Fake LinkedIn Profiles Created Using GAN Photos
· 4 informes