32 minutterHurtig LLM-inferens med vLLM og PagedAttention
Forstå, hvorfor inferensmotorer, batchbehandling og hukommelse til KV-cache har stor betydning for økonomien i selvhostet inferens.
Prompt Engineering. Gennemgår Anthropics promptcaching op mod Geminis context caching med konkrete latenstid- og omkostningsreduktioner pr. use case (long-document chat, few-shot, multi-turn). Nedbrydningen af cache-write-tillæg kontra cache-read-rabat er præcis det, artiklen antager, når den taler om, hvornår caching betaler sig.
Optaget i august 2024, så modelnavne og priser pr. token er forældede. Mekanikken cache-write-tillæg kontra cache-read-rabat holder stadig; tjek aktuelle provider-prissider, før du kører tallene for din workload.
Du kan estimere, hvornår promptcaching betaler sig, ved at veje cache-write-tillæg op mod read-besparelser for dine reelle workloads.
Arbejdskendskab til LLM-API-prissætning og workloads med lange prompts.
Senest gennemgået: 18. maj 2026
Fortsæt ad den samme læringsvej med de næste kuraterede videoer.
32 minutterForstå, hvorfor inferensmotorer, batchbehandling og hukommelse til KV-cache har stor betydning for økonomien i selvhostet inferens.
34 minutterEvaluér AI-produktprissætning og specialisering omkring målbare outcomes frem for antal sæder.
6 minutterGenkend kernearkitekturen i en voice-agent og de fejltilstande, der påvirker kundetillid i rigtige opkald.
Håndplukkede eksterne kurser, der går i dybden med dette emne.
Emory University Goizueta Business School faculty
The deeper, university-level counterpart to our beginner HubSpot marketing pick — Emory's business-school treatment goes past 'how to prompt' into training generative models for brand-specific output, the purchase-funnel economics of AI-generated content, and a full module of genuine skepticism about when generative AI is and isn't worth using in marketing.
IBM AI Academy
GenAI-æraens svar på spørgsmålet om ledelsesstrategi. Tre korte kurser målrettet virksomhedsledere — uden krav om teknisk baggrund — om, hvor generativ AI skaber værdi, hvordan teknologien styres ansvarligt, og hvordan et uklart "vi bør bruge AI" omsættes til et konkret anvendelsesscenarie, der kan forsvares. Bedømt til 4,6 på tværs af cirka 700 anmeldelser. Tag det helst før din næste beslutning om AI-budgettet.