18:50Prompt Engineering
Compara la caché de prompts de Anthropic con la caché de contexto de Gemini mediante reducciones concretas de latencia y coste para chat con documentos largos, *few-shot* y conversaciones de varios turnos. El desglose entre el recargo por escribir en caché y el descuento por leer de ella es exactamente lo que presupone el artículo al explicar cuándo compensa.
Qué aprenderás: Podrás estimar cuándo compensa la caché de prompts comparando el recargo de escritura con el ahorro de lectura para tus cargas reales.
Qué ver o saber antes: Conocimiento operativo sobre el precio de las API de LLM y las cargas de trabajo con prompts largos.
Nota de AI Expert: Grabado en agosto de 2024, por lo que los nombres de los modelos y los precios por token están desactualizados. El mecanismo de recargo por escritura en caché contra descuento por lectura en caché sigue vigente; verifica las páginas de precios actuales de los proveedores antes de realizar los cálculos para tu carga de trabajo.
