Ai2 libera AstaBrief, un modelo de código abierto para informes científicos

Ai2 ha anunciado la liberación de AstaBrief, un modelo de lenguaje de 8 mil millones de parámetros diseñado específicamente para la generación de informes científicos citados. Esta herramienta, que se integra en la plataforma Asta, permite a los investigadores generar reportes con fuentes verificabl

El lenguaje humano se vuelve indistinguible de la IA por la imitación

Un escritor reflexiona sobre cómo la interacción con modelos de lenguaje ha alterado su propio estilo, eliminando rasgos distintivos como las comas y palabras específicas para evitar que su texto sea detectado como generado por IA. Este fenómeno, descrito como un bucle de retroalimentación, se basa

PISA: atención bloqueada dispersa con complejidad log-lineal

El mecanismo de atención bloqueada dispersa (block-sparse attention) ofrece una alternativa eficiente al costo cuadrático de la atención auto en modelos de lenguaje de gran escala, pero su implementación práctica se ve limitada por la complejidad computacional en la selección de bloques. El artículo

JevBench v1.3.0 clasifica alternativas de Jev por rendimiento

JevBench v1.3.0 es una herramienta de evaluación técnica que compara el rendimiento de múltiples alternativas de software Jev, incluyendo modelos de lenguaje y sistemas de inferencia. La versión 1.3.0 actualiza la clasificación de los modelos, reflejando cambios en las métricas de evaluación y propo

Estudio revela comportamiento no monótono en el peso de datos en LMs

Un estudio reciente analiza las leyes de escalado del peso de datos en modelos de lenguaje (LM) de pesos internos y abiertos, identificando un comportamiento no monótono a medida que aumentan las escalas de los modelos. Los investigadores miden cómo la reducción de la pérdida en una secuencia de ent

Recolección de 30 prompts SVG para modelos de lenguaje

Este sitio web presenta una colección de 30 prompts para la generación de gráficos SVG, diseñados para evaluar la creatividad de los modelos de lenguaje en 2025 y 2026. La iniciativa, inspirada en el famoso test de Simon Willison sobre un pelícano en bicicleta, consiste en asignar a los modelos tare

La humanidad construyó los Registros del DESTINO por accidente

El autor parte de su experiencia con el videojuego Chrono Cross para construir una analogía con el presente. En el juego, los habitantes del archipiélago de El Nido consultan unos terminales conocidos como los Registros del DESTINO (FATE), dispositivos que en realidad son terminales conectados a una

El regreso de los modelos de difusión continua para lenguaje

La investigación en modelos de difusión continua para el procesamiento del lenguaje natural experimenta un notable resurgimiento tras años de estancamiento, desafiando la dominancia histórica de los métodos discretos y autoregresivos. Aunque las técnicas de difusión discreta habían desplazado a las

La creación de Abulafia: cuando la máquina solo refleja al usuario

El ensayo parte de 'El péndulo de Foucault' (1988), de Umberto Eco, para examinar un mecanismo cognoscitivo que sigue plenamente vigente. En la novela, los editores Belbo, Diotallevi y Casaubon alimentan un pequeño programa en BASIC llamado Abulafia —bautizado así por el cabalista Abraham Abulafia—

La ceguera al contenido generado por IA

Un profesional describe cómo su cerebro ha aprendido a identificar y descartar de forma automática los textos generados por inteligencia artificial, un fenómeno que él denomina "ceguera a la IA" por analogía con la conocida ceguera publicitaria. Relata que al recibir documentos de trabajo —diseños,

Seed: un agente mínimo que crece a partir de un único archivo Python

Seed es un proyecto de código abierto que propone el agente de inteligencia artificial más pequeño posible: un único archivo congelado, seed.py, que se limita a conectar un modelo de lenguaje con una sola herramienta (exec, para ejecutar comandos bash) y a cargar un prompt de sistema desde un archiv

Embeddings al descubierto: aritmética de vectores explicada con Word2Vec

Este artículo es una crónica divulgativa del capítulo 2 de The Hundred-Page Language Models Book, centrada en los embeddings: la representación densa de palabras que usan los modelos de lenguaje. Frente a los vectores one-hot, que desperdician memoria y no capturan relaciones semánticas, los embeddi

Qwen3.8 27B: análisis de inteligencia, rendimiento y precio

Qwen3.8 27B es un modelo de inteligencia artificial de pesos abiertos desarrollado por Alibaba, con 27.000 millones de parámetros y licencia Apache 2.0, lo que permite su uso comercial y su autoalojamiento. La versión analizada en esta ficha es la variante con razonamiento (chain-of-thought), capaz

Los modelos de IA se están volviendo más ignorantes a propósito

Los modelos de lenguaje actuales intercambian conocimiento factual por capacidad de razonamiento, y lo hacen de forma deliberada. Modelos como GLM-5.2 (99,2% en AIME 2026 con unos 40.000 millones de parámetros activos por token) o DeepSeek V4-Flash (13.000 millones activos) obtienen puntuaciones raz

La IA no supera a los matemáticos pensando, sino recordando

Un artículo divulgativo argumenta que la ventaja de los modelos de inteligencia artificial en matemáticas no reside en un razonamiento superior, sino en disponer de una memoria de trabajo simbólica prácticamente ilimitada. La memoria de trabajo humana es muy reducida: al resolver un problema hay que

OpenAI avanza su política de privacidad europea

OpenAI publicó una versión de su Política de Privacidad que entrará en vigor a finales de este mes y que está destinada a las personas situadas en el Espacio Económico Europeo, el Reino Unido y Suiza. El documento explica qué datos personales recopila la compañía, cómo los utiliza y qué tipos de inf

Predicción y compresión: dónde empieza y dónde termina la equivalencia

El reciente debate en Hacker News sobre la afirmación "comprimir es predecir" ha reunido explicaciones de 3Blue1Brown, ngrok y Salvatore Sanfilippo. Todas convergen en una idea central: si un modelo probabilístico asigna una probabilidad a cada continuación posible de una secuencia, un codificador e

Cómo funcionan las marcas de agua en texto generado por IA

## Cómo funcionan las marcas de agua en texto generado por IA El reciente anuncio de Anthropic sobre el sistema de marcas de agua en el texto generado por Claude ha sacado del terreno teórico una tecnología que hasta ahora solo existía en publicaciones académicas. A diferencia de las marcas de agua

Por qué comprimir datos es, en el fondo, predecirlos

El blog de ngrok publica un artículo didáctico que explica la relación profunda entre la compresión de datos y el modelado de lenguaje. El texto parte de la idea de que compresores como gzip o Brotli y los modelos de lenguaje grandes (LLM) resuelven, en esencia, el mismo problema: predecir la redund

Afirmar que programar esta resuelto es no entender la ingenieria de software

Afirmar que "programar está resuelto" es no entender la ingeniería de software Cada pocas semanas, alguien declara que programar está resuelto. Si se refieren a convertir un problema bien especificado en código que funciona, tienen parte de razón. Pero, ¿fue alguna vez escribir código ejecutable el

Por qué no leeré ficción escrita por un modelo de lenguaje

Por qué no leeré ficción escrita por un modelo de lenguaje En un ensayo publicado en su blog personal, el ingeniero y escritor conocido como mccormick.cx ha encendido un debate inesperado al explicar por qué se niega a leer novelas cuya redacción haya sido generada, total o parcialmente, por un mod

Estudio analiza la saturación de 60 benchmarks de inteligencia artificial

Un estudio académico publicado en arXiv examina un fenómeno creciente en la evaluación de modelos de inteligencia artificial: la saturación de los benchmarks. Los autores definen formalmente este concepto y lo aplican a 60 benchmarks de modelos de lenguaje, analizando 14 propiedades vinculadas a la

La voz de ninguna parte: la encíclica sobre la IA y los programadores

La encíclica 'Magnifica humanitas', publicada por el Papa León XIV en mayo de 2026, ha trasendido por primera vez el ámbito católico y ha circulado por X, LinkedIn, Hacker News, Reddit y lobste.rs. Su autor, un ingeniero de software nacido durante el pontificado de Juan Pablo II, analiza el document

Comprobar si un texto es humano es absurdo

Un ensayo de opinión argumenta que la creciente exigencia de demostrar que un texto fue escrito «a mano», sin asistencia de inteligencia artificial, confunde el método de producción con la autoría intelectual. La premisa, sostiene el texto, es técnicamente regresiva y profundamente excluyente: presu

Gigatoken: un tokenizador en Rust hasta 1000 veces más rápido que HuggingFace

Gigatoken es una biblioteca de tokenización para modelos de lenguaje escrita en Rust que alcanza velocidades de hasta 24,53 GB/s en CPU AMD EPYC 9565 de 144 núcleos, frente a las 24,8 MB/s que ofrece el tokenizador de HuggingFace para GPT-2. Esto representa una aceleración cercana a 989 veces respec

Receta de RL en NVFP4 para modelos de lenguaje: el aprendizaje de los 4 bits

El equipo de humans& presenta una receta de aprendizaje por refuerzo (RL) en precisión NVFP4 de 4 bits, desarrollada en colaboración con RadixArk y NVIDIA, que logra mantener la dinámica de entrenamiento en alta precisión y, al mismo tiempo, aprovechar los aumentos de throughput que ofrece el hardwa

¿Podría la próxima gran novela ser escrita por una IA (y podrías notarlo)?

El artículo examina hasta qué punto es posible distinguir un texto humano de uno generado por modelos de lenguaje. Claire Hardaker, profesora de lingüística forense en la Universidad de Lancaster, ha creado el test Bot or Not, en el que los aciertos rondan solo el 60%. Los lectores suelen apoyarse e

Claude desarrolla un espacio de trabajo global para el razonamiento interno

Investigadores de Anthropic han descubierto que Claude, su modelo de lenguaje, ha desarrollado un conjunto de patrones neuronales internos que actúan como un "espacio de trabajo global", similar al que los neurocientíficos asocian con la conciencia accesible en humanos. Este espacio, denominado J-sp

Qwen-AgentWorld: modelos del mundo en lenguaje para agentes generales

El equipo de QwenLM presenta Qwen-AgentWorld, una familia de modelos del mundo basados en lenguaje que predicen la dinámica de entornos a partir de observaciones y acciones, con el objetivo de reforzar el razonamiento y la planificación de agentes generales. El trabajo se articula en dos ejes. En pr

«Navegando juntas por lo desconocido»: mi novio idiota artificial

Una cronista recibe el encargo de su editora de probar un novio basado en inteligencia artificial. Parte de una posición escéptica: considera que conversar con un chatbot como si fuera una persona supone rendirse ante una visión del mundo que reduce a los demás a pura eficiencia. Al mismo tiempo, ya

Apertus Mini: modelos de lenguaje abiertos para una IA soberana

La Swiss AI Initiative, consorcio formado por EPFL, ETH Zurich y el Centro Suizo de Computación Científica (CSCS), ha presentado Apertus Mini, una colección de 16 modelos de lenguaje de pequeño tamaño diseñados para demostrar técnicas de destilación y cuantización. El proyecto se enmarca en el lanza

No quiero que mi buscador piense por mí

El auge de los resúmenes generados por inteligencia artificial en los principales buscadores erosiona la capacidad del usuario para verificar la información, oculta los desacuerdos entre fuentes y debilita el ecosistema de la web al reducir el tráfico hacia los sitios originales, según sostiene este

Tras 16 años, un usuario deja Gmail por las funciones de IA intrusivas

En un ensayo personal, el usuario JP describe una experiencia de uso cada vez más invasiva de Gmail, donde las funciones de inteligencia artificial se imponen sin ser solicitadas. Al abrir un mensaje con comentarios sobre un proyecto, lo primero que apareció fue un resumen generado por IA que el usu

Modelos de lenguaje: técnica reduce tamaño sin perder calidad

Investigadores han desarrollado una nueva técnica para comprimir incrustaciones (embeddings) de modelos de lenguaje, mejorando significativamente la eficiencia sin sacrificar la calidad de la recuperación de información. La técnica, denominada 'poly-autoencoder', combina un codificador PCA (Principa

Modelos de lenguaje: ¿datos sintéticos para el futuro?

El entrenamiento de modelos de lenguaje (LLM) está enfrentando un problema creciente: la necesidad de cantidades exponencialmente mayores de datos para seguir mejorando. La disponibilidad de texto natural de alta calidad se proyecta que se agotará en 2028, y el texto de internet está contaminado con

Modelos de lenguaje: nueva técnica mejora el razonamiento

Este artículo explora una técnica innovadora para mejorar el razonamiento de los modelos de lenguaje, inspirada en el éxito de algoritmos de búsqueda en árbol como AlphaZero en juegos de mesa. La idea central es aplicar la 'Tree Search Distillation' (Destilación de Búsqueda en Árbol) a modelos de le

IA: Menos datos, más cálculo, ¿el nuevo reto?

El campo de la inteligencia artificial, y en particular el modelado del lenguaje, enfrenta un desafío creciente: la escasez de datos. Si bien la capacidad de cómputo ha aumentado exponencialmente, la cantidad de datos de entrenamiento disponibles no sigue el mismo ritmo. Esto crea un cuello de botel

IA corrige errores y envía sugerencias a blogs

Un desarrollador ha creado un sistema automatizado que utiliza modelos de lenguaje para corregir errores ortográficos en blogs y enviar comentarios a los autores. El proyecto, iniciado en febrero de 2026, busca aplicar la IA de manera útil y amable, automatizando tareas repetitivas en lugar de enfoc

Heretic: herramienta elimina censura de IA automáticamente

Un nuevo conjunto de herramientas llamado Heretic está automatizando la eliminación de restricciones de seguridad (censura) de modelos de lenguaje basados en transformadores, sin necesidad de costosos procesos de reentrenamiento. Desarrollado por P-E-W y disponible en GitHub, Heretic combina técnica