Separa entrada y salida
La mayoría de proveedores cobran de forma distinta los tokens que envías y los que genera el modelo. Una tarea de resumen puede tener mucha entrada y poca salida; una generación larga, el patrón contrario.
Calcula ambos componentes por separado y multiplícalos por el volumen mensual esperado.
Incluye las repeticiones
El modelo con la tarifa más baja no siempre ofrece el menor coste por resultado aceptado. Si un flujo requiere reintentos, correcciones o validaciones adicionales, esos tokens también forman parte del coste.
Mide con casos representativos antes de fijar un presupuesto anual.
Actualiza precios y supuestos
Las tarifas, los descuentos de caché y los límites de cada canal cambian. Conserva la fecha de cada precio y revisa el cálculo cuando cambies de versión, proveedor o tipo de prompt.
Siguiente paso