Wagtail CMS documenta los fallos de su desafío de uso de GLM 5.3 Flash

Fuentes: Wagtail CMS documents failures of its GLM 5.3 Flash usage challenge

Wagtail CMS ha publicado un informe detallado sobre su intento de utilizar exclusivamente el modelo de lenguaje GLM 5.3 Flash durante todo el mes de septiembre. El objetivo era mantener un control estricto sobre el consumo de recursos, limitando el uso a este modelo eficiente para reducir costes y huella de carbono. Sin embargo, el proyecto resultó ser un fracaso parcial, ya que solo se logró mantener el uso del modelo objetivo durante la primera mitad del mes. En la segunda mitad, el equipo se vio obligado a recurrir a otros modelos como DeepSeek V4.1 Flash y Qwen 3.8 Flash debido a problemas de infraestructura y disponibilidad de capacidad en los proveedores de inferencia.

El informe destaca que el 'vibe coding' (programación asistida por IA sin planificación exhaustiva) generó un coste inesperado de 450 millones de tokens y 150 dólares en una sola noche, un error que podría haberse evitado con una mejor selección de modelos. Además, la alta demanda de la comunidad por modelos de frontera de Pareto causó degradación en el rendimiento de GLM 5.3 Flash, obligando a alternar entre proveedores. A pesar de que el desafío técnico no se completó al 100%, el equipo aprendió lecciones cruciales sobre la gestión de presupuestos para experimentación, la medición local de energía y el uso de técnicas de agentes más eficientes. Para el mes de octubre, Wagtail planea implementar un enfoque más riguroso, priorizando modelos de bajo coste y eficiencia energética, y utilizar los datos de sus benchmarks para guiar a los desarrolladores hacia opciones más sostenibles.