Anthropic presenta el Índice de Razonamiento Conceptual para evaluar IA en tareas sin verificación empírica
Anthropic ha presentado el Conceptual Reasoning Index (CRI), un índice que mide la capacidad de los modelos de lenguaje para razonar sobre cuestiones donde no existe verificación empírica ni matemática posible, como los dilemas de alineación, gobernanza de IA o cooperación frente a riesgos catastróf
