¿Es el fin del RAG? El nuevo almacenamiento en caché de prompts de Anthropic

19 minutosAvanzadoCreadorPrompt EngineeringIA para empresas

Prompt Engineering. Compara la caché de prompts de Anthropic con la caché de contexto de Gemini mediante reducciones concretas de latencia y coste para chat con documentos largos, *few-shot* y conversaciones de varios turnos. El desglose entre el recargo por escribir en caché y el descuento por leer de ella es exactamente lo que presupone el artículo al explicar cuándo compensa.

Nota de AI Expert

Grabado en agosto de 2024, por lo que los nombres de los modelos y los precios por token están desactualizados. El mecanismo de recargo por escritura en caché contra descuento por lectura en caché sigue vigente; verifica las páginas de precios actuales de los proveedores antes de realizar los cálculos para tu carga de trabajo.

Qué aprenderás

Podrás estimar cuándo compensa la caché de prompts comparando el recargo de escritura con el ahorro de lectura para tus cargas reales.

Qué ver o saber antes

Conocimiento operativo sobre el precio de las API de LLM y las cargas de trabajo con prompts largos.

Última revisión: 18 may 2026

Ver siguiente

Continúa por el mismo itinerario de aprendizaje con los siguientes vídeos complementarios seleccionados.