Qué es el precio por tokens
El precio por tokens cobra el texto por entrada y salida, incluido el razonamiento no visible; revisa también los demás cargos. Cómo se lee la tabla oficial y el error típico.
3 min de lectura · Datos comprobados el 20/9/2026
Qué es
En estas API, el texto puede cobrarse por tokens de entrada y salida, incluido razonamiento no visible. No pagas por mensaje ni por persona: pagas por lo que se consume, y conviene revisar también los cargos por herramientas y otros servicios.
El precio depende del modelo, y el tamaño no garantiza cuál cuesta más: se consulta en la tabla de cada uno. Y puede diferenciar lo que entra de lo que sale, con ritmos distintos según el proveedor. La tabla de precios de cada uno, en su página oficial, es la única fuente que vale: los precios cambian; la forma de contarlos, mucho menos.
Explicado fácil
Es la báscula del mercado. Nadie paga «por llevarse verduras»: pagas por peso, y hay productos que pesan más que otros. En la IA, el peso son los tokens: un encargo con un archivo largo pesa mucho más que una pregunta de una línea; el tamaño del modelo no determina los tokens del encargo ni su precio.
Ejemplo práctico
Una gestoría prepara cada mes el resumen de situación de cada cliente de la cartera. La persona a cargo define el encargo con un agente: datos del cliente, dos líneas de contexto, formato de salida. El agente lo prueba con un cliente, la persona revisa el resultado y aprueba.
En la consola de uso se ve lo que pesó cada resumen, y el mes entero es la suma de todos. El día que alguien pega el expediente completo «por si acaso», el mismo resumen consume más; conviene comprobar si mejora la respuesta.
Así no
Pegar el expediente completo de cada cliente «por si acaso» y pagar el periodo en peso muerto.
Así sí
Probar el encargo mínimo que da buen resultado y medir su consumo en la consola antes de repetirlo en toda la cartera.
El precio por tokens premia el encargo que sabe qué necesita.
Por qué te importa
Porque es el costo que crece con el éxito: si el proceso sirve, se repite, y cada repetición consume. Entenderlo te da dos palancas: elegir el modelo según la tarea —el pequeño para lo rutinario— y afinar el encargo para no arrastrar contexto que no aporta. Las dos se ven en el mismo lugar: la consola de uso, petición por petición.
El error típico
Comparar «precios por mensaje» entre proveedores sin preguntar qué mide cada uno: mensajes, tokens de entrada, tokens de salida o créditos propios. El segundo: mirar solo el precio del token y olvidar cuántos consume tu encargo. El precio unitario bajo con un encargo pesado puede salir más caro que el precio alto con un encargo afinado.
No lo confundas con
La suscripción. La suscripción es cuota fija por persona; el precio por tokens es consumo medido. La comparación, en Suscripción y API.
El costo total. El precio por tokens es la materia prima; el costo total suma horas de montaje y mantenimiento. Está en Qué es el costo total de una IA.
Relacionados
Token · Modelo pequeño y modelo grande · Caché de encargos · Procesamiento por lotes · Suscripción y API