Conectar tu conocimiento al modelo: recuperación sin palabras grandes
Los cuatro pasos
Fragmentación. Corta por estructura —sección, encabezado, fila— y guarda en cada fragmento el nombre del documento y la ruta de encabezados. El corte arbitrario es la causa más común de respuestas malas.
Indexación. Combinar la búsqueda basada en significado con la búsqueda literal supera a cualquiera de las dos por separado, especialmente en hebreo y con identificadores.
Recuperación. Pocos fragmentos relevantes, no muchos. Más fragmentos cuestan más, ralentizan y añaden ruido.
Respuesta. Indica al modelo que responda solo del material, cite una fuente y diga explícitamente cuando no hay respuesta.
Las trampas
Permisos olvidados en la recuperación; documentos contradictorios sin priorización por fecha; preguntas que en realidad son consultas de datos y no búsqueda de texto; y ortografía hebrea no normalizada.
Cómo saber que funciona
Mide los dos pasos por separado: ¿apareció el fragmento correcto entre los resultados? y, dado que apareció, ¿es la respuesta precisa? Medir solo el resultado final no te dice qué corregir.
En profundidad
Construye un conjunto de preguntas donde cada una tiene un fragmento correcto conocido, y mide con qué frecuencia apareció entre los cinco primeros. Esa es la métrica que impulsa la mayoría de las mejoras. Añade una reformulación de la pregunta antes de la búsqueda, y conserva el contexto de un turno anterior para las preguntas de seguimiento.