Divisão em trechos (chunking)
Dividir os documentos em passagens menores antes de fazer os embeddings para RAG. O tamanho do trecho equilibra a precisão de recuperação e a completude do contexto, e afeta diretamente o número de vetores e o custo.
O que é
Cada trecho vira um vetor no banco vetorial. Trechos pequenos (100-200 tokens) dão correspondências nítidas mas podem perder o contexto ao redor; trechos grandes (500-1.000) carregam mais contexto mas diluem a relevância e custam mais para enviar ao LLM.
Por que importa
Reduzir pela metade o tamanho do trecho mais ou menos dobra o número de vetores e o custo de embeddings, e muda quantos trechos você precisa recuperar para cobrir uma resposta. É um botão de ajuste com linha direta para a conta.