Lección 4.1 · 30 min

Caché de prompts: paga menos por releer el mismo contexto

Activa la caché de prompts con cache_control, elige entre 5 minutos y 1 hora, lee los campos de caché en usage y calcula con precios reales cuánto ahorra el asistente de Viajes Kukulcán.

Al final de la lección 3.4 calculaste cuánto cuesta que el asistente relea el mismo tarifario en cada pregunta. En Viajes Kukulcán el número asusta: el prompt de sistema más el tarifario de invierno suman unos 30,000 tokens, y el asistente atiende 120 consultas al día. Cada consulta paga esos 30,000 tokens completos aunque no hayan cambiado ni una coma. La caché de prompts existe exactamente para esto.

Qué verás en esta lección

  1. Qué se guarda y cómo se reutiliza
  2. Duración y precios
  3. Forma 1: caché automática
  4. Forma 2: puntos de corte explícitos
  5. Leer usage correctamente
  6. Cálculo con los números de la agencia
  7. Otros beneficios
  8. Práctica
  9. Resumen
  10. Quiz

El resto de la lección es para alumnos. Se abre al comprar el curso o con la Membresía de IA con Clase.

Ver precios Ya compré: acceder o empieza con una lección gratis