Ploy, un agente que diseña y programa sitios web de marketing de forma autónoma, ha sustituido a Claude Opus 4.8 por GPT-5.6 Sol como modelo predeterminado tras cuatro meses sin encontrar un rival capaz. En pruebas comparativas, GPT-5.6 completó las mismas páginas en menos de la mitad del tiempo de ejecución (3 min 42 s frente a 8 min 00 s), con un 27 % menos de coste (2,22 $ frente a 3,06 $) y una puntuación visual ligeramente superior (0,970 frente a 0,936). Además, el nuevo modelo utiliza aproximadamente la mitad de tokens de salida y genera código más conciso: un mismo archivo de estilos globales pasó de 17 957 caracteres y 174 variables a 2 508 y 45.
La migración no fue trivial pese a usar el SDK de IA de Vercel. El equipo describe tres frentes clave. Primero, depuraron el banco de pruebas: cerca de un tercio de los fallos iniciales no eran del modelo, sino de un arnés ajustado a las peculiaridades de Opus. Segundo, rediseñaron los esquemas de herramientas: GPT-5.6 envía los 25 parámetros posibles aunque no los necesite, e inventaba valores plausibles —como offset: 0— que provocaban que entre el 52 % y el 64 % de las lecturas de archivos volvieran vacías. La solución fue transformar los campos opcionales en requeridos pero anulables y eliminar los nulos en el límite del proveedor. Tercero, reconstruyeron el sistema de caché de prompts, ya que las cachés de OpenAI y Anthropic funcionan de forma muy distinta y una configuración incorrecta hacía parecer GPT-5.6 un 50 % más caro de lo real.
Con esos ajustes, las lecturas vacías cayeron al 0 % y el agente necesitó un 30 % menos de llamadas de herramientas. Ploy reconoce que el diseño de GPT-5.6 tiende a un estilo limpio y genérico cuando no se le guía, pero asegura que con dirección adecuada alcanza resultados de nivel profesional.
