Economía de modelos
Cuánto cuesta realmente un token
Una forma práctica de leer precios de entrada, salida, caché y generación antes de lanzar una función.

Qué aprenderás
- Budget input and output tokens separately.
- Long context and tool schemas can dominate input spend.
- Use live account-group pricing for the final production estimate.
Antes de empezar
- Basic HTTP and API knowledge
Leave with a concrete implementation checklist and a testable starting point.
Conclusiones clave
- Presupuesta entrada y salida por separado.
- El contexto largo y los esquemas de herramientas pueden dominar el coste.
- Confirma el precio del grupo de cuenta antes de producción.
Dos formas de facturación
Los modelos de texto suelen medirse por tokens de entrada y salida. Los modelos de imagen y video suelen cobrarse por elemento generado.
Una estimación de chat debe incluir ambos lados; una de video debe empezar por el número de generaciones y el precio unitario.
La entrada no es todo el coste
Los prompts del sistema, documentos recuperados, historial y esquemas de herramientas aumentan los tokens de entrada. La longitud de salida es otra variable.
Las lecturas en caché pueden tener una tarifa distinta y cambiar qué modelo resulta más económico.
Una fórmula sencilla
Estima (tokens de entrada × tarifa de entrada) + (tokens de salida × tarifa de salida) y multiplica por el número de solicitudes.
Los precios de EasyAI son referencias del grupo predeterminado; confirma el presupuesto final en la consola.
Cómo elegir
| Criterio | Opción A | Opción B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
Pasos de implementación
- 1
Mide prompts representativos.
- 2
Estima entrada, salida y caché por separado.
- 3
Multiplica por volumen y añade margen.
- 4
Verifica el precio en la consola antes de lanzar.
Ejemplo para copiar
const monthlyCost =
(inputTokens / 1_000_000) * inputUsdPerMillion +
(outputTokens / 1_000_000) * outputUsdPerMillion +
(cachedTokens / 1_000_000) * cacheUsdPerMillion;Preguntas frecuentes
¿El precio mostrado aplica a todas las cuentas?
No necesariamente; es una referencia del grupo predeterminado.
¿Cómo estimo un modelo de razonamiento?
Usa trazas reales, porque la salida puede ser mucho mayor que en un chat corto.
Fuentes
- EasyAI documentationFuente verificada 2026-08-27