18:50Prompt Engineering
Käy läpi Anthropicin prompt cachingin Geminiin context cachingiin verrattuna konkreettisilla viive- ja kustannusvähennyksillä käyttötapauksittain (pitkän asiakirjan chat, few-shot, monivuoro). Cache-write-lisämaksun vs. cache-read-alennuksen erittely on tasan se, mitä artikkeli olettaa puhuessaan, milloin välimuisti maksaa itsensä takaisin.
Mitä sinun pitäisi oppia tästä: Osaat arvioida, milloin kehotteiden välimuisti maksaa itsensä takaisin punnitsemalla cache-write-lisämaksuja luku säästöjä vasten oikeilla työkuormillasi.
Katso tai hallitse ensin: Työtuntemus LLM-API-hinnoittelusta ja pitkien kehotteiden työkuormista.
AI Expert -huomio: Nauhoitettu elokuussa 2024, joten mallinimet ja token-kohtaiset hinnat ovat vanhentuneita. Cache-write-lisämaksu vs. cache-read-alennus -mekaniikka pitää edelleen; tarkista nykyiset toimittajien hinnoittelusivut ennen lukujen ajamista työkuormallesi.
