Un columnista de Android Authority afirma que los modelos recientes de Claude, el chatbot de Anthropic, se han vuelto notoriamente más restrictivos yerran a la hora de interpretar la intención del usuario. Tras haber sido un firme defensor del asistente por su memoria y su capacidad de seguir hilos extensos, el autor describe que en las últimas semanas ha multiplicado los rechazos y advertencias morales, incluso en escenarios creativos ficticios o preguntas básicas sobre religión.
El artículo detalla varios casos: al desarrollar una trama de ficción sobre extraterrestres que presentan textos que desafían creencias religiosas, Claude se negó a continuar; al preguntar por los paralelismos entre Zoroastro y el judaísmo, el chatbot también frenó la conversación. Según el columnista, el problema no es aislado: los modelos Sonnet 5, Opus 4.8 y Sonnet 4.6 muestran más resistencia, mientras que Opus 4.6 y 4.7 se mantienen más permisivos.
El autor atribuye el cambio a un endurecimiento de las barreras de seguridad de Anthropic tras un incidente previo con un modelo llamado Fable 5, que las autoridades consideraron un riesgo de seguridad. Aunque reconoce que parte del problema depende de cómo se formulen las instrucciones, concluye que la creciente necesidad de ser extremadamente claro en cada prompt está restando agilidad al uso de Claude, hasta el punto de replantearse su fidelidad a la herramienta.
