Por qué llamar a los LLM «predictores del siguiente token» es un modelo mental equivocado
Describir los grandes modelos de lenguaje como simples «predictores del siguiente token» es una aproximación útil como punto de partida, pero incompleta y, según este argumento, equivocada como modelo mental. Los modelos base sí aprenden repitiendo, sobre corpus masivo, los tokens que aparecen despu
