Saltar al contenido
MasterMath

Calculadora de coste de tokens de IA

Cuánto cuesta usar un modelo de lenguaje por petición, al día y al mes, con precios distintos de entrada y salida y el descuento de la caché.

Coste al mes

—

Coste al mes—
Por petición—
Al día—
Lo que pesa la salida—
Peticiones por cada unidad de dinero—
Tokens al mes—
Palabras por petición, aprox.—
Al año—

Cómo se ha calculado

    La fórmula

    coste = entrada ÷ 10⁶ × precio de entrada + salida ÷ 10⁶ × precio de salida

    De dónde sale

    Un modelo de lenguaje cobra por token, y cobra distinto según el sentido: la salida cuesta varias veces más que la entrada. Eso invierte la intuición: una respuesta de quinientos tokens cuesta más que un contexto de mil quinientos, aunque tenga un tercio de los tokens. Por eso la ficha separa las dos partidas y dice qué porcentaje del coste es la salida, que es el dato que decide si conviene pedir respuestas más cortas o recortar el contexto.

    Cómo calcularlo a mano

    1. Divide los tokens de entrada entre un millón y multiplica por su precio
    2. Lo mismo con los de salida, con su precio
    3. Suma las dos: es el coste de una petición
    4. Multiplica por las peticiones al día y por treinta

    Lo que conviene saber

    La caché de contexto cobra con descuento la parte de la entrada que se repite entre peticiones —instrucciones del sistema, documentos largos— y solo esa parte: si la mitad de la entrada viene de caché con un 90 % de descuento, la entrada cuesta un 45 % menos y la salida exactamente lo mismo. Y sobre las palabras: un token son unos tres cuartos de palabra en inglés y algo menos en español, porque las palabras largas y los acentos se parten en más trozos. La cifra que da la página sirve para hacerse una idea, no para facturar.

    Preguntas frecuentes

    ¿Cuánto cuesta una petición a un modelo de lenguaje?

    Entrada y salida por separado, cada una a su precio por millón. Con 1.500 de entrada a 3 y 500 de salida a 15, algo más de un céntimo.

    ¿Por qué la salida cuesta más?

    Porque generar es más caro que leer. Los proveedores lo reflejan con un precio por token varias veces mayor.

    ¿Cuántas palabras es un token?

    Unos tres cuartos en inglés y algo menos en español. Es una aproximación.

    ¿Qué ahorra la caché?

    Solo la parte de la entrada que se repite entre peticiones, y con el descuento que fije el proveedor. La salida se paga igual.