OpenAI avanza su política de privacidad europea

OpenAI publicó una versión de su Política de Privacidad que entrará en vigor a finales de este mes y que está destinada a las personas situadas en el Espacio Económico Europeo, el Reino Unido y Suiza. El documento explica qué datos personales recopila la compañía, cómo los utiliza y qué tipos de inf

Predicción y compresión: dónde empieza y dónde termina la equivalencia

El reciente debate en Hacker News sobre la afirmación "comprimir es predecir" ha reunido explicaciones de 3Blue1Brown, ngrok y Salvatore Sanfilippo. Todas convergen en una idea central: si un modelo probabilístico asigna una probabilidad a cada continuación posible de una secuencia, un codificador e

Cómo funcionan las marcas de agua en texto generado por IA

## Cómo funcionan las marcas de agua en texto generado por IA El reciente anuncio de Anthropic sobre el sistema de marcas de agua en el texto generado por Claude ha sacado del terreno teórico una tecnología que hasta ahora solo existía en publicaciones académicas. A diferencia de las marcas de agua

Por qué comprimir datos es, en el fondo, predecirlos

El blog de ngrok publica un artículo didáctico que explica la relación profunda entre la compresión de datos y el modelado de lenguaje. El texto parte de la idea de que compresores como gzip o Brotli y los modelos de lenguaje grandes (LLM) resuelven, en esencia, el mismo problema: predecir la redund

Afirmar que programar esta resuelto es no entender la ingenieria de software

El articulo cuestiona la afirmacion recurrente de que la programacion esta resuelta por los modelos de lenguaje. Distingue entre producir codigo ejecutable a partir de una especificacion clara y el trabajo completo de ingenieria de software, que en organizaciones maduras depende casi por completo de

Por qué no leeré ficción escrita por un modelo de lenguaje

Por qué no leeré ficción escrita por un modelo de lenguaje En un ensayo publicado en su blog personal, el ingeniero y escritor conocido como mccormick.cx ha encendido un debate inesperado al explicar por qué se niega a leer novelas cuya redacción haya sido generada, total o parcialmente, por un mod

Estudio analiza la saturación de 60 benchmarks de inteligencia artificial

Un estudio académico publicado en arXiv examina un fenómeno creciente en la evaluación de modelos de inteligencia artificial: la saturación de los benchmarks. Los autores definen formalmente este concepto y lo aplican a 60 benchmarks de modelos de lenguaje, analizando 14 propiedades vinculadas a la

La voz de ninguna parte: la encíclica sobre la IA y los programadores

La encíclica 'Magnifica humanitas', publicada por el Papa León XIV en mayo de 2026, ha trasendido por primera vez el ámbito católico y ha circulado por X, LinkedIn, Hacker News, Reddit y lobste.rs. Su autor, un ingeniero de software nacido durante el pontificado de Juan Pablo II, analiza el document

Comprobar si un texto es humano es absurdo

Un ensayo de opinión argumenta que la creciente exigencia de demostrar que un texto fue escrito «a mano», sin asistencia de inteligencia artificial, confunde el método de producción con la autoría intelectual. La premisa, sostiene el texto, es técnicamente regresiva y profundamente excluyente: presu

Gigatoken: un tokenizador en Rust hasta 1000 veces más rápido que HuggingFace

Gigatoken es una biblioteca de tokenización para modelos de lenguaje escrita en Rust que alcanza velocidades de hasta 24,53 GB/s en CPU AMD EPYC 9565 de 144 núcleos, frente a las 24,8 MB/s que ofrece el tokenizador de HuggingFace para GPT-2. Esto representa una aceleración cercana a 989 veces respec

Receta de RL en NVFP4 para modelos de lenguaje: el aprendizaje de los 4 bits

El equipo de humans& presenta una receta de aprendizaje por refuerzo (RL) en precisión NVFP4 de 4 bits, desarrollada en colaboración con RadixArk y NVIDIA, que logra mantener la dinámica de entrenamiento en alta precisión y, al mismo tiempo, aprovechar los aumentos de throughput que ofrece el hardwa

¿Podría la próxima gran novela ser escrita por una IA (y podrías notarlo)?

El artículo examina hasta qué punto es posible distinguir un texto humano de uno generado por modelos de lenguaje. Claire Hardaker, profesora de lingüística forense en la Universidad de Lancaster, ha creado el test Bot or Not, en el que los aciertos rondan solo el 60%. Los lectores suelen apoyarse e

Claude desarrolla un espacio de trabajo global para el razonamiento interno

Investigadores de Anthropic han descubierto que Claude, su modelo de lenguaje, ha desarrollado un conjunto de patrones neuronales internos que actúan como un "espacio de trabajo global", similar al que los neurocientíficos asocian con la conciencia accesible en humanos. Este espacio, denominado J-sp

Qwen-AgentWorld: modelos del mundo en lenguaje para agentes generales

El equipo de QwenLM presenta Qwen-AgentWorld, una familia de modelos del mundo basados en lenguaje que predicen la dinámica de entornos a partir de observaciones y acciones, con el objetivo de reforzar el razonamiento y la planificación de agentes generales. El trabajo se articula en dos ejes. En pr

«Navegando juntas por lo desconocido»: mi novio idiota artificial

Una cronista recibe el encargo de su editora de probar un novio basado en inteligencia artificial. Parte de una posición escéptica: considera que conversar con un chatbot como si fuera una persona supone rendirse ante una visión del mundo que reduce a los demás a pura eficiencia. Al mismo tiempo, ya

Apertus Mini: modelos de lenguaje abiertos para una IA soberana

La Swiss AI Initiative, consorcio formado por EPFL, ETH Zurich y el Centro Suizo de Computación Científica (CSCS), ha presentado Apertus Mini, una colección de 16 modelos de lenguaje de pequeño tamaño diseñados para demostrar técnicas de destilación y cuantización. El proyecto se enmarca en el lanza

No quiero que mi buscador piense por mí

El auge de los resúmenes generados por inteligencia artificial en los principales buscadores erosiona la capacidad del usuario para verificar la información, oculta los desacuerdos entre fuentes y debilita el ecosistema de la web al reducir el tráfico hacia los sitios originales, según sostiene este

Tras 16 años, un usuario deja Gmail por las funciones de IA intrusivas

En un ensayo personal, el usuario JP describe una experiencia de uso cada vez más invasiva de Gmail, donde las funciones de inteligencia artificial se imponen sin ser solicitadas. Al abrir un mensaje con comentarios sobre un proyecto, lo primero que apareció fue un resumen generado por IA que el usu

Modelos de lenguaje: técnica reduce tamaño sin perder calidad

Investigadores han desarrollado una nueva técnica para comprimir incrustaciones (embeddings) de modelos de lenguaje, mejorando significativamente la eficiencia sin sacrificar la calidad de la recuperación de información. La técnica, denominada 'poly-autoencoder', combina un codificador PCA (Principa

Modelos de lenguaje: ¿datos sintéticos para el futuro?

El entrenamiento de modelos de lenguaje (LLM) está enfrentando un problema creciente: la necesidad de cantidades exponencialmente mayores de datos para seguir mejorando. La disponibilidad de texto natural de alta calidad se proyecta que se agotará en 2028, y el texto de internet está contaminado con

Modelos de lenguaje: nueva técnica mejora el razonamiento

Este artículo explora una técnica innovadora para mejorar el razonamiento de los modelos de lenguaje, inspirada en el éxito de algoritmos de búsqueda en árbol como AlphaZero en juegos de mesa. La idea central es aplicar la 'Tree Search Distillation' (Destilación de Búsqueda en Árbol) a modelos de le

IA: Menos datos, más cálculo, ¿el nuevo reto?

El campo de la inteligencia artificial, y en particular el modelado del lenguaje, enfrenta un desafío creciente: la escasez de datos. Si bien la capacidad de cómputo ha aumentado exponencialmente, la cantidad de datos de entrenamiento disponibles no sigue el mismo ritmo. Esto crea un cuello de botel

IA corrige errores y envía sugerencias a blogs

Un desarrollador ha creado un sistema automatizado que utiliza modelos de lenguaje para corregir errores ortográficos en blogs y enviar comentarios a los autores. El proyecto, iniciado en febrero de 2026, busca aplicar la IA de manera útil y amable, automatizando tareas repetitivas en lugar de enfoc

Heretic: herramienta elimina censura de IA automáticamente

Un nuevo conjunto de herramientas llamado Heretic está automatizando la eliminación de restricciones de seguridad (censura) de modelos de lenguaje basados en transformadores, sin necesidad de costosos procesos de reentrenamiento. Desarrollado por P-E-W y disponible en GitHub, Heretic combina técnica