Qué es la caché de encargos
La caché de encargos es una función de algunas API: la parte del encargo que se repite se guarda ya procesada y se reutiliza. Para qué sirve, qué exige y dónde se comprueba.
3 min de lectura · Datos comprobados el 20/9/2026
Qué es
La caché de encargos es una función que algunos proveedores ofrecen en su API: cuando la primera parte de tus encargos es siempre la misma —instrucciones, formato, base de conocimiento—, el proveedor puede guardarla ya procesada y reutilizarla en las peticiones siguientes.
La idea es simple: no volver a hacer el trabajo de leer lo idéntico. Tiende a abaratar y acelerar las repeticiones; cuánto depende de cada proveedor, y las reglas están en su documentación oficial.
Explicado fácil
Es la mise en place de una cocina profesional. El cocinero que usará cebolla picada toda la noche la pica una vez al empezar. No vuelve a picar por cada platillo: repite lo ya preparado, y el esfuerzo se aprovecha en cada orden.
La caché de encargos procesa una vez las instrucciones comunes y las tiene listas para cada tarea que llega.
Ejemplo práctico
La inmobiliaria redacta la ficha de cada propiedad con el mismo comienzo: el manual de estilo de la casa, el formato de salida, los pasos de la tarea. Lo único que cambia de ficha a ficha son los datos de la propiedad.
Sin caché, cada ficha paga la lectura del manual otra vez. Con caché —cuando el proveedor la ofrece y el sistema la usa—, esa parte se procesa una vez y las fichas siguientes la reutilizan. En la consola de uso, las peticiones aparecen con la parte reutilizada señalada: ahí se comprueba.
Así no
Reescribir las instrucciones de un encargo a otro: la parte repetida deja de ser idéntica y la reutilización puede reducirse o perderse.
Así sí
Fijar las instrucciones comunes tal cual, al inicio del encargo, y cambiar solo los datos de cada tarea.
La caché premia la disciplina: lo repetido, idéntico; lo variable, al final.
Por qué te importa
Porque en los procesos repetitivos —fichas, resúmenes, respuestas con la misma base— la parte fija puede pesar más que la variable, y sin darte cuenta pagas la misma lectura muchas veces. La caché es una de las formas de que esa repetición cueste menos, junto con afinar el encargo y elegir bien el modelo. Cuánto abarata se mira en su documentación y en tu consola, no en promesas.
El error típico
El primero: creer que la caché es memoria del modelo o que sirve para cualquier repetición. Es una función de la API, con reglas: la parte repetida va idéntica —un cambio puede reducirla o anularla— y, en los proveedores que la ofrecen, tiende a exigir que esté al inicio del encargo. El segundo: suponer que ya está funcionando. Se comprueba en la consola de uso, petición por petición, no por fe.
No lo confundas con
La memoria de la IA. La memoria guarda conversaciones entre sesiones; la caché reutiliza texto idéntico dentro de la API. Una se nota en el chat; la otra, en el consumo. La distinción completa, en Contexto y memoria.
El precio por tokens. El precio es la tarifa; la caché reutiliza procesamiento y puede abaratar la parte repetida; revisa los cargos por guardarla y reutilizarla.
Relacionados
Precio por tokens · Token · Encargo (prompt) · Contexto