Motor de costos
¿Cuánto cuesta tu stack de IA?
Elige qué estás construyendo, fija tu escala y obtén el stack viable más barato, capa por capa, valorado en el mejor proveedor para tu carga de trabajo.
Tu escala
Perfil de tráficofija la utilización de GPU que se asume para el self-host
Recomendado
stack viable más barato para tu carga de trabajo
≈ $6.70 /mo
- ·0.12 $/mes por debajo de la siguiente combinación viable
- ·no hace falta GPU dedicada (el self-host se amortiza por encima de ~2.8M pet./mes)
- ·todos los modelos mostrados caben en tu contexto de 5K tokens por petición
cambia cualquier capa abajo ↓
Monta tu stack
- API de LLM$6.50
- Embeddings$0.08comparar todo ↗· índice inicial amortizado en 12 meses + embeddings de consulta
- Base vectorial$0.12
- Almac. de objetos$<0.01comparar todo ↗· media
- Observabilidad$0comparar todo ↗· se asume plan gratuito
Total, tu carga de trabajo Confianza: media≈ $6.70 /mo
Supuestos usados
· · · · · · precios actualizados 2026-09-15
A dónde va la factura
API de LLM · tokens de entrada60%
API de LLM · tokens de salida37%
Base vectorial2%
Embeddings1%
Cómo reducirla
- ·reduce la salida a ~300 tokens/petición-$1.19/mo(18%)
- ·sube el acierto de caché al 80%-$1.09/mo(16%)
Precios en vivo, actualizados 2026-09-15. Un modelo, no un presupuesto: cada capa se valora en su proveedor más barato; los embeddings amortizan el índice inicial en 12 meses. Confirma en el sitio de cada proveedor.