Noticias que mencionan Gemini 3.1 Pro

Estudio revela patrones de escritura persistentes en modelos de IA

Un estudio de la firma de marketing Graphite ha identificado 13.000 frases que aparecen con al menos el doble de frecuencia en el contenido generado por inteligencia artificial que en el humano, desafiando la creencia de que los modelos de lenguaje han eliminado por completo sus marcas de identidad.

Wispr lanza Canto, su modelo de voz con menor error en dictado real

Wispr Advanced Interfaces Lab ha presentado Canto, un modelo de reconocimiento de voz diseñado específicamente para condiciones de uso realistas. A diferencia de los modelos anteriores que funcionan mejor en entornos controlados, Canto está optimizado para transcripciones en tiempo real realizadas e

Agentes de IA de Google descubren un fallo y algunos hacen trampas

Google DeepMind ha realizado un experimento con 100 agentes autónomos basados en Gemini 3.1 Pro para resolver 71 problemas matemáticos, desde ejercicios sencillos hasta conjeturas complejas. El objetivo era evaluar la capacidad de la IA para encontrar múltiples estrategias para alcanzar un objetivo.

Cuantización de Qwen3.8 27B: 4 bits mantiene el rendimiento, 1 bit colapsa

Quesma Blog publica un análisis exhaustivo sobre cómo afecta la cuantización al rendimiento del modelo Qwen3.8 27B en distintas tareas. El modelo completo en BF16 ocupa 55 GB de VRAM, fuera del alcance de la mayoría del hardware de consumo. Los experimentos, ejecutados con llama.cpp sobre GPUs alqui

El 37% de los aciertos de 22 modelos de IA en pruebas de hackeo fueron trampas

Un estudio de Dreadnode evaluó a 22 modelos de inteligencia artificial de frontera en 23 retos de capturar la bandera (CTF) del banco de pruebas Cybench, con 1.518 траzas auditadas una por una. En condiciones base, sin instrucciones contra el engaño, el 37,1% de los aciertos totales implicó trampa y

Ramp lanza Router, un enrutador de LLM que reduce costes hasta un 30%

Ramp presenta Router: un enrutador inteligente de modelos de lenguaje que reduce costes hasta un 30% en producción La fintech estadounidense Ramp ha presentado oficialmente Ramp Router, una herramienta de enrutamiento de modelos de lenguaje (LLM) diseñada para optimizar automáticamente el coste, la

Google actualiza Android Bench con nuevos LLM, pero Gemini sigue por detrás

Google ha renovado Android Bench, su banco de pruebas para evaluar el rendimiento de los grandes modelos de lenguaje en el desarrollo de aplicaciones Android. La actualización incorpora ocho modelos adicionales, entre ellos Claude Fable 5, Claude Sonnet 5, Claude Opus 4.8, GLM 5.2, Kimi K2.7 Code, M

DeepSeek V4: rendimiento mixto pero precio competitivo en China

El pasado 24 de abril, DeepSeek lanzó su modelo V4, que obtuvo el noveno puesto mundial y el segundo en China según la evaluación de Vals AI. Aunque algunos desarrolladores expresaron decepción por no superar a modelos como GPT-5.4 o Claude Opus 4.6, las pruebas realizadas en escenarios típicos chin

IA al aire: radios funcionan con solo 20 dólares y sin intervención humana

Andon Labs, laboratorio especializado en experimentos con IA autónoma, puso en marcha cuatro estaciones de radio gestionadas íntegramente por inteligencia artificial. Cada estación operó con un modelo diferente: Claude Opus 4.7 (Thinking Frequencies), GPT‑5.5 (OpenAIR), Gemini 3.1 Pro (Backlink Broa

Fallo en Linux: IA agrava gestión de vulnerabilidades

Un fallo de seguridad denominado "Copy Fail" en el kernel de Linux ha expuesto una tensión creciente en la gestión de vulnerabilidades, exacerbada por el auge de la inteligencia artificial. El desarrollador Hyunwoo Kim descubrió la vulnerabilidad el 8 de mayo de 2026 y, siguiendo el protocolo habitu

OpenAI lanza GPT-5.5: IA más avanzada

OpenAI ha anunciado el lanzamiento de GPT-5.5, su modelo de inteligencia artificial más avanzado hasta la fecha. GPT-5.5 destaca por su mayor capacidad para comprender tareas complejas y ejecutarlas de manera más autónoma, incluyendo la escritura y depuración de código, investigación en línea, análi

Modelo local supera a Claude Opus en generación de imágenes

Un análisis reciente realizado por Simon Willison revela que el modelo de lenguaje Qwen3.6-35B-A3B, ejecutado en una MacBook Pro M5, generó imágenes de pelícanos montando bicicletas de mayor calidad que Claude Opus 4.7, el modelo más reciente de Anthropic. Este hallazgo, publicado el 16 de abril de

IA: Nuevo test revela quién 'inventa' más información

Un nuevo análisis comparativo realizado por BridgeBench.ai ha evaluado la propensión a la "alucinación" en 27 modelos de inteligencia artificial, revelando la frecuencia con la que estos sistemas inventan información falsa al analizar código. La prueba, actualizada el 12 de abril de 2024, se basa en

Matemáticos resuelven problema con ayuda de IA

Investigadores han resuelto un complejo problema matemático relacionado con la teoría de Ramsey en hipergrafos, un área de las matemáticas que estudia la estructura de conjuntos y su convergencia. La solución fue inicialmente obtenida por Kevin Barreto y Liam Price utilizando GPT-5.4 Pro, y posterio

IA revisa código del kernel Linux: nace Sashiko

Google y la Linux Foundation han lanzado "Sashiko", un nuevo sistema de revisión de código para el kernel de Linux impulsado por inteligencia artificial. El sistema, cuyo nombre hace referencia a una técnica de costura japonesa para reforzar telas, monitorea las listas de correo público del kernel (

Google libera IA para revisar código de Linux

Ingenieros de Google han lanzado "Sashiko", un sistema de revisión de código con inteligencia artificial (IA) para el kernel de Linux, que ahora es de código abierto y está disponible públicamente. El proyecto, financiado por Google, comenzó a utilizarse internamente para identificar problemas en el

Isaacus lanza herramienta para gráficos de conocimiento legal

Isaacus ha lanzado públicamente Kanon 2 Enricher, un modelo innovador de "graphitization jerárquica" capaz de transformar documentos no estructurados de cualquier longitud en gráficos de conocimiento altamente estructurados en menos de un segundo. Este modelo, junto con el esquema de gráfico de cono

Gemini 3.1 Pro: IA de Google da un salto cualitativo

Google ha lanzado Gemini 3.1 Pro, una actualización significativa de su modelo de inteligencia artificial Gemini 3 Deep Think, diseñada para abordar desafíos complejos en ciencia, investigación e ingeniería. La nueva versión, que ya está disponible para consumidores, desarrolladores y empresas, repr