Onko tämä RAG:n loppu? Anthropicin UUSI prompt caching

19 minuuttiaEdistynytRakentajaPrompt EngineeringTekoäly liiketoiminnassa

Prompt Engineering. Käy läpi Anthropicin prompt cachingin Geminiin context cachingiin verrattuna konkreettisilla viive- ja kustannusvähennyksillä käyttötapauksittain (pitkän asiakirjan chat, few-shot, monivuoro). Cache-write-lisämaksun vs. cache-read-alennuksen erittely on tasan se, mitä artikkeli olettaa puhuessaan, milloin välimuisti maksaa itsensä takaisin.

AI Expert -huomio

Nauhoitettu elokuussa 2024, joten mallinimet ja token-kohtaiset hinnat ovat vanhentuneita. Cache-write-lisämaksu vs. cache-read-alennus -mekaniikka pitää edelleen; tarkista nykyiset toimittajien hinnoittelusivut ennen lukujen ajamista työkuormallesi.

Mitä sinun pitäisi oppia tästä

Osaat arvioida, milloin kehotteiden välimuisti maksaa itsensä takaisin punnitsemalla cache-write-lisämaksuja luku säästöjä vasten oikeilla työkuormillasi.

Katso tai hallitse ensin

Työtuntemus LLM-API-hinnoittelusta ja pitkien kehotteiden työkuormista.

Viimeksi tarkistettu: 18.5.2026

Katso seuraava

Jatka samalla oppimisreitillä seuraaviin valikoituihin oheisvideoihin.