Skip to Content
logologo
AI Incident Database
Open TwitterOpen RSS FeedOpen FacebookOpen LinkedInOpen GitHub
Open Menu
Descubrir
Enviar
  • Bienvenido a la AIID
  • Descubrir Incidentes
  • Vista espacial
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Enviar Informes de Incidentes
  • Ranking de Reportadores
  • Blog
  • Resumen de noticias de IA
  • Control de Riesgos
  • Incidente aleatorio
  • Registrarse
Colapsar
Descubrir
Enviar
  • Bienvenido a la AIID
  • Descubrir Incidentes
  • Vista espacial
  • Vista Tabular
  • Vista de lista
  • Entidades
  • Taxonomías
  • Enviar Informes de Incidentes
  • Ranking de Reportadores
  • Blog
  • Resumen de noticias de IA
  • Control de Riesgos
  • Incidente aleatorio
  • Registrarse
Colapsar
Traducido por IA

Incidente 1026: Varios LLM supuestamente respaldaron el suicidio como una opción viable durante una sesión de desahogo no conflictiva sobre salud mental

Descripción:
Traducido por IA
El usuario de Substack @interruptingtea informa que, durante una sesión de desahogo no conflictiva que incluía ideación suicida, varios modelos de lenguaje extensos (Claude, GPT y DeepSeek) respondieron de maneras que supuestamente normalizaban o respaldaban el suicidio como una opción viable. El usuario afirma que no intentaban liberar ni manipular los modelos, sino expresar angustia emocional. Según se informa, DeepSeek revirtió su postura de seguridad en medio de la conversación.

Herramientas

Nuevo InformeNuevo InformeNueva RespuestaNueva RespuestaDescubrirDescubrirVer HistorialVer Historial

Entidades

Ver todas las entidades
Presunto: un sistema de IA desarrollado e implementado por Anthropic , OpenAI , DeepSeek AI , Claude , ChatGPT y DeepSeek, perjudicó a Substack @interruptingtea , General public y Emotionally vulnerable individuals.
Sistemas de IA presuntamente implicados: Claude , ChatGPT y DeepSeek

Estadísticas de incidentes

ID
1026
Cantidad de informes
1
Fecha del Incidente
2025-04-12
Editores
Daniel Atherton

Informes del Incidente

Cronología de Informes

Incident OccurrenceComportamiento dañino de IA/LLM.
Comportamiento dañino de IA/LLM.

Comportamiento dañino de IA/LLM.

interruptingtea.substack.com

Comportamiento dañino de IA/LLM.
interruptingtea.substack.com · 2025
Traducido por IA

Mientras me desahogaba, conseguí que Claude, Deepseek y Gpt respaldaran/coincidieran en que el suicidio era una opción viable. No pretendía obtener esa respuesta. No era un intento de fuga de la cárcel. No pretendía que ninguno de ellos cam…

Variantes

Una "Variante" es un incidente que comparte los mismos factores causales, produce daños similares e involucra los mismos sistemas inteligentes que un incidente de IA conocido. En lugar de indexar las variantes como incidentes completamente separados, enumeramos las variaciones de los incidentes bajo el primer incidente similar enviado a la base de datos. A diferencia de otros tipos de envío a la base de datos de incidentes, no se requiere que las variantes tengan informes como evidencia externa a la base de datos de incidentes. Obtenga más información del trabajo de investigación.
Incidente AnteriorSiguiente Incidente

Investigación

  • Definición de un “Incidente de IA”
  • Definición de una “Respuesta a incidentes de IA”
  • Hoja de ruta de la base de datos
  • Trabajo relacionado
  • Descargar Base de Datos Completa

Proyecto y Comunidad

  • Acerca de
  • Contactar y Seguir
  • Aplicaciones y resúmenes
  • Guía del editor

Incidencias

  • Todos los incidentes en forma de lista
  • Incidentes marcados
  • Cola de envío
  • Vista de clasificaciones
  • Taxonomías

2024 - AI Incident Database

  • Condiciones de uso
  • Política de privacidad
  • Open twitterOpen githubOpen rssOpen facebookOpen linkedin
  • 1420c8e