Noticias que mencionan Gemma

Satlyt levanta 8 millones para ejecutar IA en satélites

Satlyt, fundada por Rama Afullo, exgerente de producto de Google y SpaceX, ha recaudado 8 millones de dólares en una ronda semilla para desarrollar software que permite ejecutar modelos de inteligencia artificial en satélites. La empresa, con sede en Sunnyvale, California, y Nairobi, busca ofrecer u

Ollama: plataforma para ejecutar modelos de IA locales y de código abierto

Ollama es una herramienta de software diseñada para permitir a los desarrolladores y usuarios finales ejecutar modelos de lenguaje de gran escala (LLM) de forma local y con código abierto. Su objetivo principal es facilitar la integración de modelos como Kimi, GLM, MiniMax, DeepSeek, GPT-oss, Qwen,

Token-space font compiler: crear fuentes con ancho uniforme por token

El Token-space font compiler es una herramienta de software que genera fuentes tipográficas donde cada token de lenguaje tiene un ancho uniforme, facilitando la visualización precisa de modelos de lenguaje de gran escala. Este sistema transforma el texto en una fuente TTF (TrueType) que integra las

Guía técnica para ejecutar modelos de IA locales en Mac

Cualquier Mac con chip Apple Silicon puede ejecutar modelos de lenguaje de gran escala (LLM) de forma local, una capacidad que a menudo pasa desapercibida. La viabilidad técnica depende principalmente de la memoria unificada, que permite a la CPU y la GPU compartir el mismo pool de RAM, a diferencia

China lidera en modelos de pesos abiertos frente a EE. UU.

China ha superado a Estados Unidos en la competitividad de los modelos de inteligencia artificial de pesos abiertos, un cambio de tendencia que se consolidó a partir de julio de 2025. Según datos de Hugging Face, China acumula 3.200 millones de descargas, el doble que las de EE. UU., impulsado por m

GRP-Obliteration: método para desalinear modelos de IA con un solo prompt

La alineación de seguridad en los modelos de lenguaje de gran escala (LLM) presenta vulnerabilidades críticas que pueden ser explotadas mediante ajustes finos post-deploy. Un nuevo estudio, titulado 'GRP-Obliteration: Unaligning LLMs With a Single Unlabeled Prompt', introduce GRP-Oblit, una técnica

Framework JAX XLA para optimizar operaciones softmax en LLMs

El repositorio jax-softmax-bypass presenta un prototipo de concepto (PoC) arquitectónico diseñado para superar las limitaciones de memoria y ejecución en los modelos de lenguaje de gran escala (LLM). A diferencia de las librerías de producción estándar, este framework ofrece un plano de acción técni

OpenArch: implementaciones de PyTorch de arquitecturas LLM modernas

OpenArch es un repositorio de código abierto que ofrece implementaciones de PyTorch de las arquitecturas de modelos de lenguaje de gran escala (LLM) más recientes, escritas desde cero para priorizar la legibilidad y el aprendizaje sobre el rendimiento de producción. El proyecto se basa en el catálog

OUI-1: el modelo abierto que genera interfaces fiables en hardware doméstico

OUI-1 es un modelo de código abierto, basado en una versión ajustada de DiffusionGemma, capaz de generar interfaces de usuario escritas en el lenguaje openui-lang. Con 26.000 millones de parámetros totales y 4.000 millones activos, puede ejecutarse en una tarjeta gráfica de consumo (RTX 5090, en FP8

WebLLM: motor de inferencia de LLM en el navegador con aceleración WebGPU

WebLLM es un motor de inferencia de modelos de lenguaje de gran tamaño que ejecuta la carga de trabajo directamente en el navegador web, sin necesidad de servidor, gracias a la aceleración por hardware mediante WebGPU. El proyecto, publicado como repositorio de código abierto por MLC AI, ofrece una

AirLLM: cómo ejecutar modelos de 70B en una sola GPU de 4 GB

AirLLM es una biblioteca de Python de código abierto que reduce drásticamente el consumo de memoria durante la inferencia de modelos de lenguaje de gran tamaño, permitiendo ejecutar un modelo de 70B parámetros en una única GPU con apenas 4 GB de VRAM, sin recurrir a cuantización, destilación ni poda

El software abierto con IA vive su momento Kubernetes: no lo estropeemos

Los modelos de pesos abiertos se están convirtiendo en la base del próximo ecosistema de inteligencia artificial, y Estados Unidos debería competir dentro de él en lugar de aislarse. Tobi Knaup, cofundador de Mesosphere, traza un paralelismo con Kubernetes: cuando una plataforma abierta y portátil s

Eustella: qué es, cómo funciona y cuánto cuesta la IA europea con agentes

Eustella es un asistente personal de inteligencia artificial desarrollado por la empresa austríaca newsrooms.ai, con sede en Viena, que se presenta como una alternativa europea a ChatGPT, Gemini y Claude, con un enfoque centrado en la privacidad y la soberanía de los datos. Toda la información de lo

Anatomía de un LLM moderno: de los tokens a la predicción

Los modelos de lenguaje de gran tamaño (LLM) se construyen apilando bloques transformer una y otra vez, por lo que entender la maquinaria del transformer es la base para comprender su funcionamiento. Esta guía recorre los componentes esenciales de un LLM moderno sin profundizar en las matemáticas, c

Nuevo agente 'zot' simplifica el uso de modelos de IA

El proyecto 'zot', disponible a través de zot.sh, lanza una nueva herramienta de codificación diseñada para agilizar la interacción con modelos de lenguaje. Este agente, desarrollado en el lenguaje de programación Go y distribuido como un único binario estático, se destaca por su ligereza y simplici

LLMs en vuelo: Ingeniero prueba IA sin conexión

Este artículo describe un experimento realizado por Dmitri Lerko, un ingeniero, durante un vuelo de 10 horas de Londres a Las Vegas, utilizando un MacBook Pro M5 Max para ejecutar modelos de lenguaje grandes (LLMs) localmente sin conexión a internet. El objetivo era evaluar la viabilidad de realizar

Claude Code: Usuarios ahorran un 90% con código abierto

Usuarios de Claude, el modelo de lenguaje de Anthropic, están reduciendo significativamente sus costos al integrar Claude Code con Ollama, una plataforma de código abierto, según un tutorial publicado en GitHub por Coherence-Daddy. La técnica permite ejecutar tareas intensivas de programación, como

Gemma: IA crea diagramas en Chrome con WebGPU

Un equipo de desarrolladores ha presentado Gemma LLM, un modelo de lenguaje capaz de generar diagramas directamente en el navegador Chrome utilizando WebGPU. La demostración, disponible para Chrome versión 134 o superior, permite a los usuarios describir un diagrama y que Gemma lo cree como un dibuj

Rail: Nuevo lenguaje de sistemas sin dependencias de C

Un nuevo lenguaje de sistemas auto-alojado llamado 'Rail' ha sido presentado, destacando por eliminar por completo las dependencias de C y ofrecer una arquitectura innovadora. Desarrollado por Zemo-G, Rail se distingue por su compilador (4.687 líneas de código) que genera un binario ARM64 de 729 KB

IA multimodal en Mac: nueva herramienta facilita el ajuste

Un nuevo toolkit llamado 'gemma-tuner-multimodal' permite a los usuarios afinar modelos Gemma de Google para tareas de inteligencia artificial multimodal (texto, imágenes y audio) directamente en Macs con Apple Silicon. La herramienta, desarrollada por Mattmireles y disponible en GitHub, elimina la

Gemma 4: IA potente para móviles y dispositivos IoT

Google DeepMind ha anunciado el lanzamiento de Gemma 4, una nueva generación de modelos de inteligencia artificial diseñados para funcionar de manera eficiente en dispositivos móviles y dispositivos de Internet de las cosas (IoT). La novedad busca llevar capacidades avanzadas de IA a una gama más am

ZSE: Motor optimiza LLMs y reduce el uso de memoria

Un nuevo motor de inferencia para modelos de lenguaje grandes (LLM) llamado ZSE ha sido desarrollado para reducir drásticamente los requisitos de memoria, según un anuncio reciente en GitHub. Creado por Zyora-Dev, ZSE permite ejecutar modelos de lenguaje de gran tamaño con una huella de memoria sign

IA en el Navegador: Ejecuta Modelos GGUF sin Nube

MDST ha lanzado una nueva herramienta que permite ejecutar modelos de lenguaje grandes (LLMs) en formato GGUF directamente en el navegador web, sin necesidad de depender de proveedores de la nube o configuraciones complejas. Esta innovación, impulsada por WebGPU, abre la puerta a un acceso más ampli