<- Todos los términos

Tokens de entrada

Los tokens que envías al modelo: prompt de sistema, historial de la conversación, contexto recuperado y el mensaje del usuario. Normalmente la mitad más barata de la factura.

Qué es

Todo lo que el modelo lee antes de responder, contado en tokens: el prompt de sistema, el historial de chat completo que reenvías en cada turno, los documentos que pegas para RAG y el último mensaje del usuario. En conversaciones largas domina el historial.

Por qué importa

La entrada se cobra aparte de la salida y normalmente es 3-5× más barata. También tiene un techo: el modelo se niega en cuanto la entrada más la salida superarían su ventana de contexto.

Impacto en costo e infraestructura

El volumen de entrada crece con cada turno de una conversación y con cada documento de un prompt RAG, así que es la parte que escala sin que te des cuenta. La caché de prompt puede reducir hasta un ~90% el costo del prefijo repetido (prompt de sistema, ejemplos few-shot).

Conceptos relacionados

Úsalo en Obolith

Última revisión: 2026-09-01 · concepto atemporal