Los modelos pequeños ya están aquí: barajar la frontera entre coste y capacidad
Durante varias semanas el autor ha probado gpt-5.6-luna de OpenAI, un modelo rápido y económico capaz de mantener unos 100 tokens por segundo. La diferencia clave respecto a iteraciones anteriores es el coste por consulta: tareas de investigación complejas sobre miles de correos electrónicos se resu
