Simplificar y refactorizar el cálculo introductorio

El artículo «Simplifying and Refactoring Introductory Calculus», publicado en arXiv el 7 de noviembre de 2018, propone replantear la enseñanza del cálculo de primer año universitario con el objetivo de reducir la carga cognitiva del estudiante. El trabajo parte de una observación pedagógica concreta

Nuevas cotas para la constante de Grothendieck obtenidas con un sistema de IA

Un equipo de investigación anuncia nuevas cotas inferior y superior para la constante de Grothendieck (K_G), una magnitud central en análisis funcional, optimización combinatoria y complejidad computacional. Los autores demuestran que K_G se sitúa en el intervalo [6π/11, π/(2·log(1+√2)) − 10^{-4}],

Hora de avanzar: consultas sin nulos ni bolsas en bases de datos relacionales

Un artículo académico difundido en arXiv el 11 de agosto de 2026, titulado 'Time to Move on: Querying without Nulls and Bags', sostiene que dos decisiones tempranas del diseño de SQL —el uso de bolsas (bags) en lugar de conjuntos y la tolerancia de valores nulos— pueden y deben evitarse. Los autores

Hacia la enumeración bottom-up en miniKanren mediante poda y memoización

Un artículo preprint publicado en arXiv propone dos combinadores de biblioteca sobre miniKanren para trasladar la enumeración ascendente (bottom-up) con deduplicación observacional —técnica habitual en los sintetizadores relacionales programa-a-ejemplo (PBE)— al ámbito de la programación lógica rela

Zero-Mem: operaciones de memoria sin consumir tokens para agentes LLM

Zero-Mem es un sistema de memoria para agentes basados en modelos de lenguaje (LLM) que elimina el uso de tokens y de llamadas adicionales a modelos durante las operaciones de recuerdo. La idea central es que ninguna etapa del proceso de memoria —fuera de la respuesta final a la pregunta del usuario

Estudio analiza la saturación de 60 benchmarks de inteligencia artificial

Un estudio académico publicado en arXiv examina un fenómeno creciente en la evaluación de modelos de inteligencia artificial: la saturación de los benchmarks. Los autores definen formalmente este concepto y lo aplican a 60 benchmarks de modelos de lenguaje, analizando 14 propiedades vinculadas a la

Por qué los grandes modelos de lenguaje fallan en predicción tabular

Un estudio reciente publicado en arXiv investiga por qué los grandes modelos de lenguaje (LLMs), tan versátiles en tareas de lenguaje, siguen rindiendo muy por debajo de métodos clásicos de machine learning cuando se aplican a predicción sobre datos tabulares — el tipo de problema más habitual en an

La IA generativa inunda y diluye el mercado de los libros

La inteligencia artificial generativa ha inundado el mercado de los libros autopublicados en Amazon hasta el punto de diluirlo. Así lo demuestra un estudio elaborado por investigadores de la Universidad Stony Brook, Columbia Law School y la Universidad de Michigan, quienes analizaron 14.419 libros d

Hacia una teoría científica de la música: la armonía explicada

El artículo de Daniel Wilkerson, publicado en arXiv bajo el título «Harmony Explained: Progress Towards A Scientific Theory of Music», propone una fundamentación científica de la teoría musical que sustituye las explicaciones tradicionales, calificadas de «superstición no razonada», por derivaciones

¿Qué tan reales son los números reales?

En noviembre de 2004, el matemático y científico de la computación Gregory J. Chaitin publicó en arXiv el ensayo «How real are real numbers?», una pieza de matemáticas y fundamentos de la informática que cuestiona la noción clásica de número real como entidad bien definida y 'completamente existente

Zen de la programación paralela: la postura de un kernel

Un ensayo publicado en el blog smolnero reflexiona sobre el paper 'HipKittens: Fast and Furious AMD Kernels' (arXiv:2511.08083) y lo conecta con la filosofía zen de 'Mente zen, mente de principiante' de Shunryu Suzuki. El texto parte de una idea técnica: un kernel de GPU es una función especializada

Una taxonomía de futuros ominicidas con inteligencia artificial

Un informe difundido en arXiv propone una taxonomía de escenarios ominicidas vinculados a la inteligencia artificial, definidos como situaciones en las que la totalidad o la práctica totalidad de la humanidad podría morir a causa de sistemas de IA. El trabajo, presentado como preprint el 12 de julio

Cómo medimos la escritura de IA en arXiv y dónde falla la medición

Un análisis sobre 12.750 artículos de arXiv estima que alrededor de un tercio de los nuevos trabajos científicos presenta un estilo de redacción compatible con texto generado por modelos de lenguaje. El estudio, que abarca de enero de 2023 a julio de 2026 más ocho meses de control de 2021 y 2022, em

Claude Fable refuta la conjetura del Jacobiano con un contraejemplo de grado 7

El matemático Levent Alpöge anunció a través de la red social X un contraejemplo a la conjetura del Jacobiano, un problema abierto en álgebra que durante décadas había resistido los intentos de solución. El contraejemplo, identificado bajo el seudónimo Claude Fable, emplea polinomios de grado 7, un

Análisis longitudinal del historial público de seguridad de Qubes OS

Qubes OS es un caso singular para medir la seguridad de un sistema operativo, porque su arquitectura basada en compartimentos hace que los límites entre componentes sean relevantes desde el punto de vista de la protección. Este trabajo presenta un análisis longitudinal, guiado por un protocolo explí

Aurora DSQL: la base de datos SQL sin servidor y multirregión de AWS

Amazon Web Services ha detallado por primera vez en un paper académico el funcionamiento interno de Aurora DSQL, su base de datos SQL sin servidor con capacidades activas-activas multirregión. El artículo, publicado en arXiv el 14 de julio de 2026 por Marc Brooker —ingeniero de AWS— y revisado dos d

LeMario: un JEPA entrenado desde cero para predecir Super Mario Bros

LeMario es un proyecto personal que reproduce la arquitectura Joint-Embedding Predictive Architecture (JEPA) propuesta por Yann LeCun, aplicada al videojuego Super Mario Bros. El autor reescribió el modelo desde cero: un codificador de visión que comprime cada fotograma en un vector latente de 192 v

El 'horizonte de programación latente' de los agentes de código

Cuando un agente de inteligencia artificial aborda una tarea de ingeniería de software, encadena decenas de pasos de razonamiento, edición y pruebas sin que se conozca bien qué representación interna del programa está manejando el modelo de lenguaje subyacente. Un nuevo estudio, depositado en arXiv,

Análisis de los retrasos de moderación en arXiv por categoría desde 2015

Un investigador de fi-le.net publica un análisis cuantitativo de los tiempos de demora entre el envío y la publicación de preprints en arXiv, motivado por la retención de su propiaSubmission en la cola de moderación. Para ello, recopiló 63.847 artículos entre el 28 de enero de 2015 y el 4 de abril d

Los costes energéticos de la computación celular

Las células realizan cálculos continuos para interpretar señales químicas del entorno, un proceso que, según el principio de Landauer, debe implicar un consumo energético. Este trabajo cuantifica explícitamente ese coste analizando una red celular sencilla de dos componentes que implementa una versi

Prismata: una defensa frente a la inyección de prompts en agentes web

Un equipo de investigación ha presentado Prismata, un sistema de defensa diseñado para proteger a los agentes web autónomos frente a ataques de inyección de prompts entre sitios. El trabajo, publicado en arXiv, parte de la premisa de que estos agentes, al interpretar lenguaje natural como instruccio

Kani: un verificador de modelos para Rust

Kani es un verificador de modelos de código abierto diseñado para el lenguaje de programación Rust. El artículo, publicado en arXiv en julio de 2026, lo presenta como una herramienta que lleva la verificación acotada más allá de la búsqueda de errores y ofrece garantías formales de corrección. Aunqu

Código limpio frente a agentes de IA: qué cambia en su rendimiento

Un estudio controlado por pares mínimos investiga si la limpieza estructural y estilística del código fuente influye en el desempeño de los agentes autónomos de programación. Los autores presentan un protocolo de evaluación basado en parejas de repositorios idénticos en arquitectura, dependencias y

ActiveGraph: un registro de eventos como núcleo de los agentes de IA

ActiveGraph es un runtime para sistemas agentic que invierte la arquitectura habitual de los marcos de trabajo con modelos de lenguaje. En lugar de colocar la conversación en el centro y añadir después herramientas, reglas y un registro para observabilidad, el sistema sitúa un log append-only de eve

Un estudio equipara la competencia de mercado con el problema P contra NP

Un artículo académico publicado en arXiv sostiene que la eficiencia competitiva de los mercados solo es posible si el problema P no equivale a NP, una cuestión central en teoría de la computación. El autor demuestra que, si P = NP, las empresas pueden resolver de forma eficiente el problema de detec

Entrenar una sola capa de un transformer basta para replicar el ajuste por RL

Un nuevo estudio de aprendizaje automático cuestiona uno de los supuestos más asentados del post-entrenamiento de modelos de lenguaje: que los beneficios del aprendizaje por refuerzo (RL) se distribuyen de forma pareja entre todas las capas del transformer. Los autores demuestran que entrenar una ún

La caída de la economía de los teoremas

El matemático y empresario de aprendizaje automático David Bessis sostiene que la inteligencia artificial amenaza con destruir las matemáticas tal y como se conocen, aunque el impacto real será limitado. A partir de su experiencia personal —incluida una idea que nunca llegó a publicar y otra que sí,

Más de un tercio de las conversaciones con ChatGPT generan ficción

Un estudio académico reciente, firmado por Melanie Walsh y disponible en arXiv, analiza más de 500.000 conversaciones anónimas en inglés mantenidas con ChatGPT para evaluar el peso de la generación de ficción en el uso de la herramienta. Los resultados indican que más de un tercio de esas conversaci

arXiv se independiza de la Universidad de Cornell el 1 de julio de 2026

El repositorio de preprints científicos arXiv dejará de depender de la Universidad de Cornell el 1 de julio de 2026, cuando se constituya como organización sin ánimo de lucro independiente tras 25 años de vinculación con la institución académica. El cambio, que se venía gestando desde hace tiempo, a

Una guía técnica reconstruye por ingeniería inversa el Apple Neural Engine

El Apple Neural Engine (ANE) es el acelerador de matriz de función fija integrado en los chips de la casa desde el SoC A11 (iPhone y iPad) y la familia M1 (Mac), al que las aplicaciones sólo acceden a través del framework Core ML. Una nueva guía técnica, depositada en arXiv por Spencer Bryngelson, o

Proxy-KD: destilar conocimiento de modelos de lenguaje cerrados

Investigadores presentan Proxy-KD, un método de destilación de conocimiento diseñado para transferir el saber de grandes modelos de lenguaje (LLM) propietarios y opacos —como GPT-4— a modelos más pequeños y ligeros. La destilación de conocimiento tradicional requiere acceder a los estados internos d

Una revista retracta por error dos artículos de Max Planck de los años 40

Dos historiadores de la física han descubierto que la revista Naturwissenschaften, ahora llamada The Science of Nature, ha retirado sin explicación dos artículos publicados por el físico alemán Max Planck —premio Nobel de Física en 1918 por su descubrimiento de los cuantos— en la década de 1940. Los

Hybrid ClojureScript: un lenguaje que combina código textual y visual

Los lenguajes de programación dominantes obligan a los desarrolladores a expresar ideas geométricas de dominio específico únicamente mediante texto lineal. Un artículo reciente propone una solución: lenguajes híbridos que permitan crear construcciones sintácticas visuales combinables con el código t

Lift4D: reconstruir objetos dinámicos en 4D a partir de vídeo monocular

Lift4D es un marco de optimización en tiempo de prueba que reconstruye objetos dinámicos completos a partir de un único vídeo monocular, abordando un problema clásico de la visión por computador: fusionar las pistas visuales del vídeo con priors aprendidos sobre geometría y apariencia. Los métodos a

La maldición de la inversión: los LLM no generalizan relaciones bidireccionales

Un estudio de investigación identifica una limitación estructural de los modelos de lenguaje autorregresivos (LLM), bautizada como la «maldición de la inversión». El fenómeno consiste en que, cuando un modelo se entrena con una frase del tipo «A es B», no generaliza automáticamente a la forma invers

La maldición de la inversión: los LLM no generalizan relaciones simétricas

Un equipo de investigación ha documentado una limitación sistemática en los grandes modelos de lenguaje autorregresivos: la bautizada como "maldición de la inversión". El fenómeno consiste en que, cuando un modelo se entrena con frases del tipo "A es B", no generaliza automáticamente hacia la direcc

¿Basta con grep? Un estudio compara estrategias de búsqueda en agentes de LLM

Un estudio empírico reciente, publicado en arXiv, examina de forma sistemática cómo la elección de la estrategia de recuperación de información interactúa con la arquitectura del agente y el paradigma de invocación de herramientas en sistemas de búsqueda agentic basados en modelos de lenguaje de gra

Una introducción al análisis funcional para ciencia e ingeniería

El análisis funcional es la rama de las matemáticas que extiende el álgebra lineal más allá de las matrices finitas, permitiendo operar con conjuntos infinitos de funciones continuas. Su utilidad resulta decisiva en física e ingeniería, por ejemplo en el estudio de ondas en medios continuos, donde s

Crean en Leipzig un benchmark de matemáticas avanzadas para evaluar a los LLM

Un equipo de 49 matemáticos elaboró un conjunto de 100 preguntas de matemáticas a nivel de investigación con respuestas conocidas, en el marco del taller “Benchmarks in Leipzig”, celebrado entre el 1 de abril y el 15 de mayo de 2026. La mayor parte del trabajo se concentró en un taller de tres días

Estudio empírico revela que la blockchain Pearl no realiza inferencia de IA

Una investigación sometida a arXiv el 3 de junio de 2026 examina empíricamente a Pearl, una blockchain de capa 1 respaldada públicamente por figuras relevantes del sector de la inteligencia artificial. El trabajo cuantifica, por primera vez, la distancia entre lo que la red promete y lo que realment

Rotary GPU: ejecución local de modelos MoE con memoria GPU limitada

Rotary GPU es un enfoque de ejecución local para modelos grandes de mezcla de expertos (MoE) que permite correrlos en hardware de consumo con memoria limitada. Desarrollado a partir del concepto de residencia en aceleradores rotatorios, el método fue validado públicamente con el modelo Qwen3.6-35B-A

IA alucina: ¿por qué ChatGPT inventa información?

El rápido avance de los modelos de lenguaje grandes (LLMs), como ChatGPT, ha generado una gran expectación, pero también una preocupación persistente: las “alucinaciones”. En términos sencillos, una alucinación en un LLM es cuando el modelo genera información incorrecta o inventada, presentándola co

HN: Investigación de LLM pierde interés

Un análisis reciente realizado por Dylan Castillo revela una disminución en la presencia de investigaciones sobre modelos de lenguaje grandes (LLM) en Hacker News (HN), una plataforma popular entre programadores y entusiastas de la tecnología. Utilizando a Claude, un asistente de IA, Castillo rastre

Matemáticas esenciales: funciones básicas con solo dos elementos

El artículo de Andrzej Odrzywolek, publicado en arXiv, presenta un concepto fascinante: el 'minimalismo matemático'. En esencia, demuestra que es posible construir todas las funciones elementales (como exponenciales, trigonométricas, raíces cuadradas, etc.) a partir de un conjunto extremadamente red

Experto cuestiona algoritmo cuántico y su impacto en seguridad

Un experto en computación cuántica, Scott Aaronson, ha desacreditado un algoritmo recientemente anunciado llamado “JVG” (Jesse–Victor–Gharabaghi), que se promocionaba como una mejora significativa sobre el algoritmo de Shor para la factorización. El algoritmo JVG, presentado en Preprints.org, afirma

Código simple da origen a vida artificial

Un investigador ha recreado un experimento de vida artificial autorreplicante utilizando un código relativamente simple de aproximadamente 300 líneas, basado en el estudio "Computational Life" publicado recientemente en arXiv. El experimento, implementado en una cuadrícula de 240x135, inicializa ale

IA acelera matemáticas: LLMs automatizan topología

Un proyecto de investigación ha logrado automatizar una porción significativa de la topología general, un campo complejo de las matemáticas, utilizando modelos de lenguaje grandes (LLMs). Según un estudio publicado en arXiv el 6 de enero de 2026, el equipo liderado por Josef Urban ha formalizado apr

ia: modelos de lenguaje esconden 'personalidades'

Este artículo de investigación explora un descubrimiento fascinante sobre cómo funcionan los modelos de lenguaje grandes (LLMs). Tradicionalmente, se ha creído que los LLMs adoptan diferentes 'personalidades' o comportamientos a través de técnicas externas como el ajuste fino, el uso de indicaciones

Auge de preimpresiones: ¿cambio en la física teórica?

Un análisis reciente publicado en math.columbia.edu sugiere un posible cambio radical en la producción de artículos científicos, particularmente en el campo de la física teórica de altas energías (hep-th). El autor, quien permanece anónimo, ha observado un aumento significativo en el número de envío

Crítica desata debate sobre arquitectura de GPU NVIDIA

Este documento es una crítica contundente a un artículo titulado "Microbenchmarking NVIDIA’s Blackwell Architecture: An in-depth Architectural Analysis", publicado en arXiv. La crítica, escrita por Sophia Wisdom, argumenta que el artículo es fundamentalmente defectuoso y carece de sentido técnico. E

ia: modelos fallan en razonamiento simple

Los Modelos de Lenguaje Grandes (LLMs), como GPT-4 o Gemini, han demostrado una capacidad asombrosa para razonar y resolver problemas, logrando resultados impresionantes en diversas tareas. Sin embargo, a pesar de estos avances, persisten fallos de razonamiento significativos, incluso en escenarios

DeepMind crea IA de ajedrez sin búsquedas complejas

DeepMind ha desarrollado un nuevo modelo de ajedrez basado en transformadores que alcanza un nivel de juego comparable al de un Gran Maestro humano, según un estudio reciente publicado en arXiv. El modelo, entrenado utilizando datos de Stockfish, predice el valor de una posición, el valor de realiza

IA: ¿Singularidad en 2026? Un análisis predice el martes

Un análisis predictivo, aunque autodenominado "desenfrenado", sugiere que la "singularidad" (un punto de cambio radical impulsado por la IA) ocurrirá el martes 10 de febrero de 2026. El autor, utilizando métricas como los puntajes MMLU, el costo por token, los intervalos de lanzamiento de nuevas ver

Ciencia encuentra patrones matemáticos convergentes

Un nuevo estudio, publicado en arXiv y respaldado por Didier Sornette de la ETH Zurich, revela un patrón convergente en diversas disciplinas científicas (física, biología, finanzas, ingeniería) que han desarrollado de forma independiente herramientas matemáticas para predecir puntos de inflexión en

IA al límite: Evalúan su capacidad en matemáticas avanzadas

Un nuevo estudio, publicado en arXiv, evalúa la capacidad de los sistemas de inteligencia artificial actuales para responder preguntas de investigación matemática de nivel avanzado. Los autores han creado un conjunto de diez preguntas que surgieron durante su propio proceso de investigación, las cua

RLHF: Guía para el Aprendizaje con Retroalimentación Humana

Este documento presenta un libro introductorio sobre el aprendizaje por refuerzo con retroalimentación humana (RLHF), una técnica crucial para el despliegue de sistemas de aprendizaje automático de última generación. El libro explora los orígenes de RLHF, desde la literatura reciente hasta la conver