La fórmula
coste = entrada ÷ 10⁶ × precio de entrada + salida ÷ 10⁶ × precio de salida
De dónde sale
Un modelo de lenguaje cobra por token, y cobra distinto según el sentido: la salida cuesta varias veces más que la entrada. Eso invierte la intuición: una respuesta de quinientos tokens cuesta más que un contexto de mil quinientos, aunque tenga un tercio de los tokens. Por eso la ficha separa las dos partidas y dice qué porcentaje del coste es la salida, que es el dato que decide si conviene pedir respuestas más cortas o recortar el contexto.
Cómo calcularlo a mano
- Divide los tokens de entrada entre un millón y multiplica por su precio
- Lo mismo con los de salida, con su precio
- Suma las dos: es el coste de una petición
- Multiplica por las peticiones al día y por treinta
Lo que conviene saber
La caché de contexto cobra con descuento la parte de la entrada que se repite entre peticiones —instrucciones del sistema, documentos largos— y solo esa parte: si la mitad de la entrada viene de caché con un 90 % de descuento, la entrada cuesta un 45 % menos y la salida exactamente lo mismo. Y sobre las palabras: un token son unos tres cuartos de palabra en inglés y algo menos en español, porque las palabras largas y los acentos se parten en más trozos. La cifra que da la página sirve para hacerse una idea, no para facturar.