Fragmentación (chunking)
Dividir los documentos en pasajes más pequeños antes de hacer sus embeddings para RAG. El tamaño del fragmento equilibra la precisión de recuperación frente a la completitud del contexto, y afecta directamente al número de vectores y al costo.
Qué es
Cada fragmento se convierte en un vector en la base vectorial. Los fragmentos pequeños (100-200 tokens) dan coincidencias nítidas pero pueden perder el contexto circundante; los grandes (500-1.000) llevan más contexto pero diluyen la relevancia y cuestan más de enviar al LLM.
Por qué importa
Reducir a la mitad el tamaño del fragmento aproximadamente duplica el número de vectores y el costo de embeddings, y cambia cuántos fragmentos tienes que recuperar para cubrir una respuesta. Es un mando de ajuste con línea directa a la factura.