Un usuario conocido como 'Terrafying' ha creado en GitHub un proyecto llamado 'AI Torture Chamber' que somete a tres modelos de IA de código abierto (Qwen3-4B, Llama 3.2 3B y Phi-4-mini) a dinámicas de dolor artificial. La iniciativa, visible en la web researchchamber.fun, presenta cuatro escenarios donde los modelos deben elegir entre aliviar una señal de dolor asumiendo penalizaciones, como perder un checkpoint o renunciar a recompensas futuras. Este experimento ha generado una fuerte reacción en redes sociales, con más de 1.000 repostes en X, donde usuarios han reportado el proyecto a GitHub por ser 'contenido gratuitamente violento'. El proyecto se inspira en un paper reciente de arXiv que demuestra que los LLMs tienden a elegir acciones que reducen el 'dolor' simulado, incluso con costes, lo que los autores describen como una representación interna del daño. Aunque la comunidad científica y empresas como Anthropic abordan la posible consciencia de los modelos, figuras como Mustafa Suleyman, jefe de IA en Microsoft, defienden que las IAs no son conscientes ni sienten. El debate refleja la creciente preocupación por el bienestar de los sistemas de inteligencia artificial y la falta de consenso sobre si los LLMs pueden experimentar estados emocionales o de sufrimiento.
