Noticias que mencionan Kimi-K2

Kimi K2.5: 100-Agent Swarms Need $500k GPUs to Run | byteiota

Moonshot AI ha lanzado Kimi K2.5, un modelo de lenguaje de código abierto de 1 billón de parámetros que utiliza 'agent swarms' (enjambres de agentes) para tareas complejas, ofreciendo una ejecución 4.5 veces más rápida que los modelos de agente único y capacidades de codificación visual a partir de

Kimi K2.5: 100-Agent Swarms Need $500k GPUs to Run | byteiota

Moonshot AI ha lanzado Kimi K2.5, un modelo de lenguaje de código abierto de 1 billón de parámetros que utiliza 'agent swarms' (enjambres de agentes) para tareas complejas, ofreciendo una ejecución 4.5 veces más rápida que los modelos de agente único y capacidades de codificación visual a partir de

Galería online compara arquitecturas de LLM

Un repositorio en línea, alojado en sebastianraschka.com, ha sido creado para rastrear y comparar las arquitecturas de los últimos modelos de lenguaje grandes (LLM). La “Galería de Arquitecturas LLM” recopila diagramas y hojas de datos de modelos como Llama 3 8B, DeepSeek V3, Gemma 3, Qwen3, Mistral

Gram Newton-Schulz acelera el optimizador Muon en modelos de lenguaje

El optimizador Muon se ha consolidado como una herramienta clave para el entrenamiento de modelos de lenguaje de última generación como Kimi K2 o GLM-5, ya que requiere menos pasos que AdamW para alcanzar una misma pérdida. Sin embargo, cada paso de Muon es más costoso debido a su procedimiento de o

Apple reina en la IA silenciosamente mientras NVIDIA pierde su ventaja

Un artículo de opinión fechado el 17 de julio de 2026 sostiene que Apple es, sin que casi nadie lo perciba, el verdadero dominador de la inteligencia artificial, y que NVIDIA camina hacia la irrelevancia. La tesis central es que la carrera de entrenamiento de modelos es la métrica equivocada: lo dec

MOSAIC: por qué el modelo óptimo en FLOPs no lo es en tu clúster

Las leyes de escalado clásicas (estilo Chinchilla) indican qué arquitectura entrenar fijando un presupuesto de FLOPs y minimizando la pérdida. Pero los clústeres no facturan FLOPs: facturan horas de GPU. Sheng Zha, junto con Soumajyoti Sarkar y Yuxin Tang, presenta en un nuevo artículo el marco MOSA

Las universidades, ante la IA: prefieren no adaptarse

La autora, académica y antigua gestora universitaria, sostiene que la educación superior está perdiendo el tren de la inteligencia artificial. Cuatro años después de la irrupción de ChatGPT, las universidades siguen enfrascadas en debates sobre atletismo, diversidad ideológica o financiación federal