Zero-Mem: operaciones de memoria sin consumir tokens para agentes LLM

Zero-Mem es un sistema de memoria para agentes basados en modelos de lenguaje (LLM) que elimina el uso de tokens y de llamadas adicionales a modelos durante las operaciones de recuerdo. La idea central es que ninguna etapa del proceso de memoria —fuera de la respuesta final a la pregunta del usuario

MiniMax lanza M3 con un millón de tokens de contexto y multimodocidad nativa

MiniMax, la empresa china de inteligencia artificial, ha presentado M3, un nuevo modelo de IA de pesos abiertos que combina capacidades de programación de frontera y agentic con una ventana de contexto de hasta un millón de tokens y multimodocidad nativa. Según la compañía, M3 es el primer modelo de

DeepSeek-V4: IA procesa textos extensos sin problemas

DeepSeek-V4 es una nueva generación de modelos de lenguaje de gran escala (LLM) desarrollados por DeepSeek AI, que se destacan por su capacidad para procesar contextos extremadamente largos, hasta un millón de tokens. Esto representa un avance significativo, ya que la mayoría de los LLM tradicionale

Google Gemini 2.5: IA Más Rápida y Multimodal

Gemini 2.5 representa un avance significativo en la familia de modelos de IA de Google, ofreciendo una gama de opciones diseñadas para abordar diversas necesidades y prioridades. Estos modelos, que incluyen Gemini 2.5 Pro, 2.5 Flash, Gemini 2.0 Flash y Gemini 2.0 Flash-Lite, se construyen sobre la b

Claude Opus 4.6: IA supera a GPT-5 en pruebas

Anthropic ha lanzado Claude Opus 4.6, una actualización significativa de su modelo más avanzado. Esta nueva versión mejora las habilidades de codificación, la planificación, la ejecución de tareas complejas y la gestión de bases de código extensas. Destaca por su capacidad para realizar análisis fi