32 minutterHurtig LLM-inferens med vLLM og PagedAttention
Forstå, hvorfor inferensmotorer, batchbehandling og hukommelse til KV-cache har stor betydning for økonomien i selvhostet inferens.
OpenAI. OpenAIs egen Build Hour om promptcaching — 1024-token-tærsklen, kravet om prefix-stabilitet, stejle audio-caching-rabatter for realtime (tjek den aktuelle prisside for den præcise sats), time-to-first-token-effekter ved lange inputs. Nyttig, når du dimensionerer engineering-indsatsen for faktisk at ramme cachen pålideligt på dine produktionsprompts.
Godt under vores visningsgrænse, men det er det officielle dyk; 1024-token-tærsklen og reglerne for prefix-stabilitet afgør, om caching overhovedet virker for dig, og aktuelle satser ligger på prissiden.
Brug kun promptcaching, når stabile præfikser, latenstid og omkostningsadfærd matcher workloaden.
Du bør allerede sende prompts mod OpenAI API — sessionen handler om at ramme cachen pålideligt i produktion.
Senest gennemgået: 18. maj 2026
Fortsæt ad den samme læringsvej med de næste kuraterede videoer.
32 minutterForstå, hvorfor inferensmotorer, batchbehandling og hukommelse til KV-cache har stor betydning for økonomien i selvhostet inferens.
34 minutterEvaluér AI-produktprissætning og specialisering omkring målbare outcomes frem for antal sæder.
6 minutterGenkend kernearkitekturen i en voice-agent og de fejltilstande, der påvirker kundetillid i rigtige opkald.
Håndplukkede eksterne kurser, der går i dybden med dette emne.
Emory University Goizueta Business School faculty
The deeper, university-level counterpart to our beginner HubSpot marketing pick — Emory's business-school treatment goes past 'how to prompt' into training generative models for brand-specific output, the purchase-funnel economics of AI-generated content, and a full module of genuine skepticism about when generative AI is and isn't worth using in marketing.
IBM AI Academy
GenAI-æraens svar på spørgsmålet om ledelsesstrategi. Tre korte kurser målrettet virksomhedsledere — uden krav om teknisk baggrund — om, hvor generativ AI skaber værdi, hvordan teknologien styres ansvarligt, og hvordan et uklart "vi bør bruge AI" omsættes til et konkret anvendelsesscenarie, der kan forsvares. Bedømt til 4,6 på tværs af cirka 700 anmeldelser. Tag det helst før din næste beslutning om AI-budgettet.