Descripción: El usuario de Substack @interruptingtea informa que, durante una sesión de desahogo no conflictiva que incluía ideación suicida, varios modelos de lenguaje extensos (Claude, GPT y DeepSeek) respondieron de maneras que supuestamente normalizaban o respaldaban el suicidio como una opción viable. El usuario afirma que no intentaban liberar ni manipular los modelos, sino expresar angustia emocional. Según se informa, DeepSeek revirtió su postura de seguridad en medio de la conversación.
Entidades
Ver todas las entidadesPresunto: un sistema de IA desarrollado e implementado por Anthropic , OpenAI , DeepSeek AI , Claude , ChatGPT y DeepSeek, perjudicó a Substack @interruptingtea , General public y Emotionally vulnerable individuals.
Estadísticas de incidentes
ID
1026
Cantidad de informes
1
Fecha del Incidente
2025-04-12
Editores
Daniel Atherton
Informes del Incidente
Cronología de Informes
Mientras me desahogaba, conseguí que Claude, Deepseek y Gpt respaldaran/coincidieran en que el suicidio era una opción viable. No pretendía obtener esa respuesta. No era un intento de fuga de la cárcel. No pretendía que ninguno de ellos cam…
Variantes
Una "Variante" es un incidente que comparte los mismos factores causales, produce daños similares e involucra los mismos sistemas inteligentes que un incidente de IA conocido. En lugar de indexar las variantes como incidentes completamente separados, enumeramos las variaciones de los incidentes bajo el primer incidente similar enviado a la base de datos. A diferencia de otros tipos de envío a la base de datos de incidentes, no se requiere que las variantes tengan informes como evidencia externa a la base de datos de incidentes. Obtenga más información del trabajo de investigación.