Noticias que mencionan GPT 5.4-mini

IA: Nuevo test revela quién 'inventa' más información

Un nuevo análisis comparativo realizado por BridgeBench.ai ha evaluado la propensión a la "alucinación" en 27 modelos de inteligencia artificial, revelando la frecuencia con la que estos sistemas inventan información falsa al analizar código. La prueba, actualizada el 12 de abril de 2024, se basa en

OpenAI avanza: GPT-5.5 y nueva IA de imágenes

OpenAI ha anunciado una serie de actualizaciones significativas a sus modelos de IA, con lanzamientos clave en abril, marzo, febrero, enero y diciembre de 2026. El hito principal es la introducción de GPT-5.5 y GPT Image 2, diseñados para tareas profesionales complejas y generación de imágenes de va

LamBench: Nuevos LLMs compiten por el liderazgo

Una nueva evaluación comparativa llamada LamBench ha revelado un panorama competitivo entre los modelos de lenguaje grandes (LLMs). La prueba, publicada recientemente, evalúa el rendimiento de estos modelos en tareas de inferencia. El modelo 'gpt-5.4' lidera la clasificación con un 91.7% de precisió

CrofAI lidera en valor: benchmark compara agentes de codificación

Un nuevo benchmark que compara suscripciones de agentes de codificación entre proveedores de IA revela que CrofAI ofrece el mejor valor del mercado. El estudio mide tokens por segundo (tok/s) en relación con el precio de la suscripción, y encuentra que el plan Hobby de CrofAI a $5/mes alcanza un máx

Nueva arquitectura Interfaze supera a GPT-5, Claude y Gemini en benchmarks

Interfaze es una nueva arquitectura de modelo de inteligencia artificial que supera a modelos líderes como Gemini-3-Flash, Claude-Sonnet-4.6, GPT-5.4-Mini y Grok-4.3 en nueve benchmarks comparativos directos. La arquitectuta combina la especialización de redes neuronales profundas (DNN/CNN) con tran

Indexar imágenes para RAG: describir una vez y recuperar como texto

Kapa.ai, empresa que construye asistentes de IA sobre documentación técnica, detalla en un extenso post cómo procesa los millones de imágenes (capturas, diagramas de arquitectura, esquemas de circuitos, tablas de especificaciones) que viven en sus bases de conocimiento. Tras varios meses de trabajo,

Context Sculpting: probar si un modelo puede reescribir el contexto de otro

"Context Sculpting" es una propuesta de ingeniería que plantea convertir la ventana de contexto de un modelo de lenguaje en un objeto mutable, susceptible de ser inspeccionado y reescrito por otro modelo. El concepto, bautizado así por su autor con ayuda de Claude, cuestiona la visión dominante desd

HALO: optimizador jerárquico de bucles para agentes de IA auto-mejorables

HALO es una metodología de código abierto para construir harnesses de agentes que se mejoran a sí mismos de forma recursiva mediante RLMs (Reinforcement Learning Models). El proyecto, desarrollado por context-labs y disponible en GitHub, ofrece una aplicación de escritorio multiplataforma, un paquet

CopilotKit Channels: SDK para integrar agentes de IA en Slack y Teams

CopilotKit ha publicado Channels, un SDK de código abierto bajo licencia MIT que permite conectar cualquier agente de IA compatible con el protocolo AG-UI con plataformas de chat empresarial como Slack, Microsoft Teams, Discord y Telegram, manteniendo intactos los modelos, herramientas y lógica de n