Qwen3.8-Flash-Next: análisis de inteligencia, rendimiento y precio

Qwen3.8-Flash-Next es un modelo de inteligencia artificial de pesos abiertos desarrollado por la china Alibaba y lanzado el 26 de agosto de 2026, evaluado por Artificial Analysis como una de las opciones más destacadas en su segmento. Obtiene 56 puntos en el Artificial Analysis Intelligence Index, e

DeepSeek explica cómo enviar imágenes a su modelo de visión

La documentación oficial de la API de DeepSeek detalla cómo enviar imágenes al modelo deepseek-v4-flash-vision-exp, que acepta imágenes junto a texto para describir fotografías, leer texto en capturas, analizar gráficos y otras tareas. Los formatos admitidos son JPEG, PNG, GIF y WebP, identificados

Qwen3.8 27B: análisis de inteligencia, rendimiento y precio

Qwen3.8 27B es un modelo de inteligencia artificial de pesos abiertos desarrollado por Alibaba, con 27.000 millones de parámetros y licencia Apache 2.0, lo que permite su uso comercial y su autoalojamiento. La versión analizada en esta ficha es la variante con razonamiento (chain-of-thought), capaz

libargus: un runtime nativo unificado para inferencia de IA en Java

libargus es un runtime de ejecución de inteligencia artificial nativo, sin gestión de memoria automática y con cero asignaciones de memoria, que consolida en un único proceso global las canalizaciones de visión, habla y modelos de lenguaje. La biblioteca actúa como una capa fina sobre los motores de

Meta presenta Muse Spark 1.1, su nuevo modelo multimodal para tareas agentivas

Meta Superintelligence Labs ha presentado Muse Spark 1.1, una versión actualizada de su modelo Muse Spark orientada a tareas agentivas. Se trata de un modelo multimodal de razonamiento con mejoras sustanciales en el uso de herramientas y del ordenador, en programación y en comprensión multimodal, se

Cómo configurar un agente de codificación local en macOS

Montar un agente de codificación local en macOS permite ejecutar modelos de lenguaje de última generación sin depender de la nube. Este artículo explica cómo configurar una solución completa usando llama.cpp, Gemma 4 26B-A4B y el agente terminal Pi, tras la experiencia del autor con cortes de intern

Indexar imágenes para RAG: describir una vez y recuperar como texto

Kapa.ai, empresa que construye asistentes de IA sobre documentación técnica, detalla en un extenso post cómo procesa los millones de imágenes (capturas, diagramas de arquitectura, esquemas de circuitos, tablas de especificaciones) que viven en sus bases de conocimiento. Tras varios meses de trabajo,

IA genera texto legible en imágenes: nuevo método

Un investigador ha desarrollado una nueva técnica para mejorar la precisión de texto y números en imágenes generadas por inteligencia artificial. El método, descrito por Sam Collins en su blog, permite generar imágenes con texto legible y numérico, algo que los modelos de IA actuales, como Gemini, s

IA multimodal en Mac: nueva herramienta facilita el ajuste

Un nuevo toolkit llamado 'gemma-tuner-multimodal' permite a los usuarios afinar modelos Gemma de Google para tareas de inteligencia artificial multimodal (texto, imágenes y audio) directamente en Macs con Apple Silicon. La herramienta, desarrollada por Mattmireles y disponible en GitHub, elimina la

Microsoft lanza IA multimodal: Phi-4 razona con imágenes

Microsoft ha lanzado Phi-4-Vision-Reasoning-15B, un nuevo modelo de inteligencia artificial multimodal de código abierto con 15 mil millones de parámetros. Este modelo destaca por su equilibrio entre capacidad de razonamiento, eficiencia y requisitos de datos de entrenamiento, permitiendo una intera

Google lanza Gemini 3.1 Pro: su IA más potente

Google ha anunciado el lanzamiento de Gemini 3.1 Pro, su modelo de inteligencia artificial más avanzado hasta la fecha, según un comunicado publicado en febrero de 2026. Este nuevo modelo, basado en Gemini 3 Pro, es capaz de procesar y comprender una amplia gama de datos multimodales, incluyendo tex