Noticias que mencionan GPT-3

Cord: IA colabora sin flujos predefinidos

Cord es un nuevo enfoque para coordinar agentes de IA, diseñado para superar las limitaciones de los frameworks existentes como LangGraph, CrewAI, AutoGen y OpenAI Swarm. Estos frameworks tradicionales requieren que los desarrolladores predefinan la estructura de coordinación (flujos de trabajo, rol

IA sorprende: revoluciona el campo de las matemáticas

Este artículo explora el rápido avance de la inteligencia artificial (IA) en el campo de las matemáticas, desafiando predicciones anteriores sobre el ritmo de progreso. Inicialmente, el autor, Daniel Litt, observó que los modelos de lenguaje grandes (LLMs) podían generar pruebas matemáticas correcta

IA aprende de videos: automatización más inteligente

Una nueva IA, denominada FDM-1, ha sido desarrollada para permitir que los agentes de software aprendan directamente de videos, lo que abre la puerta a una automatización más avanzada. El modelo, creado por un equipo de investigadores, se entrena con una enorme cantidad de datos de video (11 millone

DoW y vigilancia: controversia por nuevos programas

Un reciente intercambio público entre el Subsecretario de Guerra Emil Michael y la divulgación de información sobre Anthropic ha generado controversia sobre la vigilancia doméstica y el papel del Departamento de Guerra (DoW). Michael, en una entrevista, defendió la legalidad de ciertas prácticas de

La maldición de la inversión: los LLM no generalizan relaciones simétricas

Un equipo de investigación ha documentado una limitación sistemática en los grandes modelos de lenguaje autorregresivos: la bautizada como "maldición de la inversión". El fenómeno consiste en que, cuando un modelo se entrena con frases del tipo "A es B", no generaliza automáticamente hacia la direcc

Talkie: IA retro revela secretos del lenguaje

Investigadores han desarrollado 'Talkie', un modelo de lenguaje de 13 mil millones de parámetros entrenado con textos en inglés anteriores a 1931, para explorar el pasado de la inteligencia artificial y comprender mejor su futuro. El proyecto, liderado por Nick Levine, David Duvenaud y Alec Radford,

Una startup enseña a robots a aprender tareas viendo un solo vídeo

La startup Generalist AI, con sede en Cambridge (Massachusetts), ha mostrado brazos robóticos capaces de aprender tareas domésticas tras ingerir un único vídeo instructivo, sin entrenamiento específico previo. En una demostración, un robot recibió la consigna de barrer un bloque hacia un cuenco con

Marco matemático para la interpretabilidad de circuitos en transformers

El estudio "A Mathematical Framework for Transformer Circuits" presenta un enfoque de interpretabilidad mecanicista para descomponer las operaciones internas de los modelos de lenguaje transformers. El objetivo es reverse-engineer los cálculos de estos modelos, similar a la descompilación de binario

Un millón de kákapos: el código abierto ante la era de la IA

En un ensayo publicado con el título 'Un millón de kákapos', el autor reflexiona sobre el futuro del software de código abierto en un mundo donde los modelos de lenguaje pueden programar con soltura. Parte de una analogía con la biología evolutiva para sostener que los organismos más robustos a larg

El regreso de los modelos de difusión continua para lenguaje

La investigación en modelos de difusión continua para el procesamiento del lenguaje natural experimenta un notable resurgimiento tras años de estancamiento, desafiando la dominancia histórica de los métodos discretos y autoregresivos. Aunque las técnicas de difusión discreta habían desplazado a las

La explosión de inferencia de IA redefine la demanda de chips y memoria

La industria de la inteligencia artificial se enfrenta a un cambio de paradigma: la demanda de inferencia ha superado a la de entrenamiento, obligando a los fabricantes de hardware a repensar sus estrategias. Mientras que los modelos de lenguaje de gran escala (LLM) han evolucionado de millones a bi

CEO de Microsoft advierte sobre riesgos de la IA y critica a Anthropic

Mustafa Suleyman, CEO de Microsoft AI, ha declarado en el podcast Decoder que las amenazas de la inteligencia artificial son reales y que la industria actual se dirige hacia un riesgo inminente. Suleyman argumenta que el enfoque actual de 'alineación' (alignment) es insuficiente y que la prioridad d

Guía interactiva para construir un LLM desde cero

LLM Visualizer es una plataforma interactiva diseñada para facilitar la comprensión profunda de los Modelos de Lenguaje Grandes (LLM) mediante la construcción práctica de un modelo funcional desde sus fundamentos. A diferencia de los tutoriales teóricos, esta herramienta opera como un laboratorio en

Un profesor reestructura sus exámenes ante la irrupción de la IA

Un profesor de la Universidad Carnegie Mellon ha rediseñado la evaluación de su curso de Machine Learning in Production para adaptarse a la capacidad de los agentes de IA para resolver tareas académicas. Tras cinco años de experiencia, el docente ha abandonado las tareas de comprensión que se realiz