Noticias que mencionan Llama-3

IA: la memoria de las conversaciones tiene un costo

La forma en que los modelos de lenguaje grandes (LLM) como ChatGPT gestionan la memoria de las conversaciones, conocida como 'KV cache', tiene un costo físico y económico significativo. Cada interacción, incluso una pregunta sencilla, se traduce en datos almacenados en la memoria de la GPU, con GPT-

Deja la IA: Ingeniero busca fundamentos en la programación

Un ingeniero de Aily Labs, empresa especializada en inteligencia artificial, ha decidido tomarse un descanso de la IA para enfocarse en la programación manual, residiendo actualmente en Brooklyn como parte de un “retiro de codificación”. Tras dos años trabajando en Aily Labs, desarrollando agentes d

Nueva herramienta encuentra el mejor LLM para tu hardware

El desarrollador Andyyyy64 ha publicado en GitHub la herramienta 'whichllm', diseñada para ayudar a los usuarios a encontrar el modelo de lenguaje grande (LLM) más adecuado para su hardware específico. La aplicación detecta automáticamente las características del sistema (GPU, CPU, RAM) y ordena los

La TEMU-ificación del software y los bienes digitales

Un artículo de opinión plantea la hipótesis de que el software, los libros, la música y la mayoría de los bienes y servicios digitales están siguiendo el mismo camino que la moda ultrarrápida: un mercado de dos niveles en el que lo generado por máquinas ocupa el segmento masivo y barato, mientras qu

AirLLM: cómo ejecutar modelos de 70B en una sola GPU de 4 GB

AirLLM es una biblioteca de Python de código abierto que reduce drásticamente el consumo de memoria durante la inferencia de modelos de lenguaje de gran tamaño, permitiendo ejecutar un modelo de 70B parámetros en una única GPU con apenas 4 GB de VRAM, sin recurrir a cuantización, destilación ni poda

Guía esencial de lectura sobre modelos de inteligencia artificial abiertos

La lista de lectura sobre modelos de inteligencia artificial abiertos, actualizada el 13 de septiembre de 2026, ofrece una visión integral del ecosistema actual. Esta recopilación de materiales de investigación se estructura en dos ejes fundamentales: los fundamentos estratégicos y la competencia ge

OpenArch: implementaciones de PyTorch de arquitecturas LLM modernas

OpenArch es un repositorio de código abierto que ofrece implementaciones de PyTorch de las arquitecturas de modelos de lenguaje de gran escala (LLM) más recientes, escritas desde cero para priorizar la legibilidad y el aprendizaje sobre el rendimiento de producción. El proyecto se basa en el catálog

WebLLM: motor de inferencia de LLM en el navegador con aceleración WebGPU

WebLLM es un motor de inferencia de modelos de lenguaje de gran tamaño que ejecuta la carga de trabajo directamente en el navegador web, sin necesidad de servidor, gracias a la aceleración por hardware mediante WebGPU. El proyecto, publicado como repositorio de código abierto por MLC AI, ofrece una

Guía interactiva para construir un LLM desde cero

LLM Visualizer es una plataforma interactiva diseñada para facilitar la comprensión profunda de los Modelos de Lenguaje Grandes (LLM) mediante la construcción práctica de un modelo funcional desde sus fundamentos. A diferencia de los tutoriales teóricos, esta herramienta opera como un laboratorio en