9 minuterLangSmith på 10 minuter
Du kan navigera bland spår, projekt och datamängder i LangSmith och läsa av tokenkostnad, latens, felfrekvens och detaljer per spann.
Dave Ebbelaar. En verksam AI-ingenjör går igenom sin faktiska utvärderingsstege – enhetstester baserade på assertioner, referensfria mätvärden, anpassning av LLM-bedömare till människor och arbetscykeln analysera/mäta/förbättra. Strukturen är den närmaste videomotsvarigheten till artikelns argument att utvärderingar är ett system för att upptäcka regressioner, inte en topplista.
Vissa verktygsval kommer att åldras, men stegen är sund: deterministiska kontroller först, därefter modellbedömda kontroller som validerats mot människor. Hoppa inte över kalibreringen bara för att det är enkelt att lägga till en LLM-bedömare.
Utforma en utvärderingsstege som upptäcker regressioner innan ändringar av prompt eller modell når användarna.
Erfarenhet av att driftsätta eller underhålla ett AI-arbetsflöde med kända exempel på fel.
Senast granskad: 18 maj 2026
Fortsätt längs samma lärstig med nästa kurerade kompletterande video.
9 minuterDu kan navigera bland spår, projekt och datamängder i LangSmith och läsa av tokenkostnad, latens, felfrekvens och detaljer per spann.
75 minuterBygg en första MCP-server och förstå hur verktyg, scheman, prompter, resurser och transporter hänger ihop.
19 minuterFörbättra verktygsdesignen så att agenter väljer rätt åtgärd med rätt parametrar.
Externa kurser som är handplockade och går djupare in i detta ämne.
Emory University Goizueta Business School faculty
The deeper, university-level counterpart to our beginner HubSpot marketing pick — Emory's business-school treatment goes past 'how to prompt' into training generative models for brand-specific output, the purchase-funnel economics of AI-generated content, and a full module of genuine skepticism about when generative AI is and isn't worth using in marketing.
IBM AI Academy
Svaret på ledningens strategiska frågor i den generativa AI-eran. Tre korta kurser direkt riktade till företagsledare – inga tekniska förkunskaper krävs – om var generativ AI skapar värde, hur den styrs ansvarsfullt och hur ett vagt ”vi borde använda AI” omvandlas till ett konkret användningsfall som går att försvara. Betyget är 4,6 baserat på ~700 omdömen. Gå den helst före nästa beslut om AI-budgeten.