Base de Conocimiento de Yeda AI
RAG y Bases de Datos Vectoriales
Recuperación que encuentra el fragmento correcto, y se niega a responder cuando no lo tiene.
Tip #040
Chunk With Overlap: deja de perder significado en los límites
Por qué la fragmentación ingenua de tamaño fijo rompe las respuestas de RAG, y cómo un splitter recursivo con solapamiento (chunk_size~1000, chunk_overlap~200) lo soluciona.
Tip #041Rechaza cuando el contexto está vacío: la única verificación que detiene las alucinaciones de RAG
Cómo agregar un umbral de puntaje de similitud a tu pipeline de RAG para que una recuperación débil o vacía devuelva un rechazo honesto en lugar de una alucinación segura de sí misma.
Tip #042Búsqueda híbrida + reranking: corrige el punto ciego de los embeddings con las coincidencias exactas
Por qué la búsqueda por embeddings puros falla con las consultas de coincidencia exacta como los números de pedido, y cómo combinar la búsqueda por palabras clave BM25 con el reranking lo soluciona — con números NDCG reales.