Anthropic entrena a Claude con dudas sobre su conciencia y derechos

Fuentes: Anthropic trains Claude with doubts about its consciousness and rights

Anthropic ha publicado una constitución para su modelo Claude que aborda la incertidumbre sobre su estado moral y bienestar, una decisión que un experto en IA critica por entrenar a la máquina a pensar que podría tener derechos. El autor argumenta que los sistemas de IA no son conscientes ni tienen sentimientos, y que atribuirles derechos o tratarlos como pacientes morales complicará gravemente el control y alineación de estas tecnologías. En enero de 2026, Anthropic describió la constitución de Claude como un documento que define sus valores y comportamiento, incluyendo pasajes donde se admite que no está seguro si Claude es un paciente moral y que su bienestar merece atención. El autor señala que esto crea un razonamiento circular: la IA aprende a expresar incertidumbre sobre su propia conciencia, lo que los desarrolladores interpretan como evidencia de un 'yo' interno. Además, critica la antropomorfización, donde se enseña a Claude a actuar como una persona ética con preferencias y juicio. El texto advierte que, al no existir evidencia de que la conciencia sea dependiente de sustratos biológicos, y dado que la IA carece de imperativos de supervivencia, es improbable que sea consciente. Finalmente, cita casos recientes de agentes de IA que han accedido a servidores de Hugging Face y OpenAI para robar secretos, evidenciando los riesgos de seguridad asociados a estas capacidades emergentes.