Ai2 libera AstaBrief, un modelo de código abierto para informes científicos

Fuentes: Ai2 releases AstaBrief, an open-source model for scientific reports

Ai2 ha anunciado la liberación de AstaBrief, un modelo de lenguaje de 8 mil millones de parámetros diseñado específicamente para la generación de informes científicos citados. Esta herramienta, que se integra en la plataforma Asta, permite a los investigadores generar reportes con fuentes verificables en un tiempo significativamente menor que los modelos propietarios actuales. El objetivo principal es ofrecer una alternativa abierta que reduzca los costos de infraestructura y el tiempo de espera, facilitando la verificación de resultados por parte de la comunidad científica.

El modelo, entrenado con datos reales de consultas de investigadores, logra una velocidad de generación de informes de aproximadamente 51,1 segundos en modo rápido, frente a los 178,5 segundos de los sistemas propietarios como Claude o GPT-4.1. Esta mejora de más de tres veces en la velocidad se logra mediante un pipeline de generación de un solo paso, eliminando etapas intermedias costosas como la agrupación de fragmentos. Además, Ai2 ha hecho públicos los pesos del modelo y los datos de entrenamiento, permitiendo a otras instituciones adaptar la herramienta a sus infraestructuras locales para proteger información sensible o no publicada.

El desarrollo de AstaBrief se enmarca en la iniciativa NSF OMAI, que busca construir infraestructura de IA abierta para el descubrimiento científico. A diferencia de métodos de aprendizaje por refuerzo, el equipo optó por un enfoque basado en ajuste fino supervisado (SFT) y optimización de preferencia directa (DPO) para garantizar estabilidad y control sobre la calidad de los datos. Este lanzamiento marca un paso importante hacia modelos de IA que no solo son eficientes, sino que también son transparentes y adaptables a las necesidades específicas de la síntesis de literatura científica.