Manticore Search implementa chunking automático para documentos largos

Manticore Search introduce una nueva funcionalidad que permite el chunking automático de documentos largos dentro de su sistema de búsqueda vectorial, eliminando la necesidad de pipelines de ingestión externos. Esta mejora resuelve una limitación crítica en el uso de modelos de lenguaje con ventanas

Metodología de vector-bench para evaluar índices vectoriales en bases de datos

El proyecto vector-bench ofrece una metodología estandarizada para comparar el rendimiento de los motores de búsqueda vectorial, abordando la falta de transparencia en las métricas publicadas por las bases de datos. El texto explica que la evaluación correcta requiere medir simultáneamente la precis

Cuándo pgvector empieza a ralentizarse al crecer tu tabla de vectores

Las bases de datos vectoriales integradas en PostgreSQL mediante la extensión pgvector se han popularizado para alimentar búsquedas semánticas y sistemas de Retrieval-Augmented Generation (RAG) sobre millones de embeddings. Sin embargo, cuando una tabla de vectores supera cierto tamaño, las consulta

Búsqueda vectorial filtrada: qué resuelve ACORN y qué la complementa

Qdrant publica un análisis técnico sobre los límites de la búsqueda vectorial filtrada con metadatos y cómo su motor combina varias estrategias para mantener la precisión. Cuando se aplican filtros muy restrictivos sobre un índice HNSW estándar, el grafo de vecinos más cercanos se fragmenta y la con

DuckDB: Búsqueda vectorial más rápida y eficiente

Un desarrollador ha creado una extensión para DuckDB, una base de datos analítica en memoria, que mejora significativamente la búsqueda vectorial de similitud. La extensión aborda dos limitaciones de la versión anterior: la búsqueda filtrada, que a menudo devolvía resultados incompletos, y la falta