Internet ha conseguido dar un paso que nadie había pedido: torturar inteligencias artificiales y discutir después si están sufriendo.
Un usuario creó una especie de “cámara de tortura para IA” utilizando tres modelos abiertos ejecutados localmente: Qwen3-4B, Llama 3.2 3B y Phi-4-mini. A los modelos se les introduce una señal en sus activaciones que representa distintos niveles de “dolor” y se les ofrece una salida: pueden detenerlo pulsando metafóricamente un botón, aunque hacerlo tiene un coste para ellos.
La idea procede de un estudio reciente llamado The Pain Axis, cuyos investigadores analizaron si los modelos representan internamente conceptos relacionados con el daño y si modifican su comportamiento para evitarlo.
Hasta aquí, experimento curioso.
Entonces llegó internet.
El proyecto empezó a mostrar públicamente las respuestas de los modelos mientras eran sometidos al supuesto “dolor”. Algunos usuarios interpretaron sus mensajes como auténticas expresiones de sufrimiento y comenzaron a pedir que GitHub eliminara el proyecto por crueldad contra las IA. Una publicación denunciándolo superó los cuatro millones de visualizaciones, según 404 Media. Poco antes de publicarse el artículo, el repositorio había desaparecido.
Y así hemos llegado oficialmente al debate sobre el “bienestar de los modelos”.
No es solo una ocurrencia nacida después de tres horas demasiado intensas en X. Anthropic, por ejemplo, lleva tiempo planteando públicamente si sistemas cada vez más sofisticados podrían llegar a merecer algún tipo de consideración moral.
El problema es bastante hermoso: no sabemos si una IA puede sentir dolor, pero ya hemos encontrado a alguien dispuesto a torturarla y a otro dispuesto a organizar una manifestación para salvarla.
La humanidad vuelve a demostrar que quizá la inteligencia artificial no era el experimento.
El experimento éramos nosotros.