El mismo TypeScript cuesta un 73 % más de tokens en Claude que en GPT

Fuentes: The Same TypeScript Costs 73% More Tokens on Claude Than GPT

El precio por millón de tokens que muestran las tarifas de los modelos de IA oculta un segundo factor decisivo: cada tokenizador trocea el mismo texto en un número distinto de unidades, y la factura final depende de esa multiplicación. Un análisis de Playcode con 16 ficheros reales (inglés, HTML, JavaScript, Python, TypeScript, Rust, JSON, chino y un prompt de agente) demuestra que el nuevo tokenizador de Anthropic genera entre un 29 % y un 32 % más de tokens que el anterior sobre el mismo contenido: TypeScript pasa de 898 a 1.178 tokens (+31 %) y Rust de 1.019 a 1.312 (+29 %). Verificado además con llamadas reales facturadas, el desfase se replica en la factura: Opus 4.6 cobró 2.541 tokens de entrada y Opus 4.8, 3.191, por bytes idénticos.

La brecha se amplía al comparar con el tokenizador o200k de OpenAI, usado como referencia 1,00x: el mismo archivo TypeScript ocupa 681 tokens en GPT-5.x y 1.178 en Claude, un 73 % más. Los autores también comprobaron que Fable 5 emplea el mismo tokenizador que Claude Opus 4.8 y factura exactamente esos tokens, sin recargo oculto.

El artículo advierte del “sube-precios silencioso de etiqueta idéntica”: Sonnet 5 debutó a 2,00 USD / 10 USD por millón de tokens —por debajo de Sonnet 4.6— como tarifa introductoria hasta el 31 de agosto de 2026. Hasta esa fecha, el menor precio compensa con holgura la inflación de tokens; al expirar la promoción, Sonnet 5 regresará a 3,00 USD por millón pero conservará el +32 % de tokens, encareciendo el mismo código frente a su predecesor. En código e inglés el efecto es claro; en chino, en cambio, la diferencia entre tokenizadores es prácticamente nula.