9 minuterLangSmith på 10 minuter
Du kan navigera bland spår, projekt och datamängder i LangSmith och läsa av tokenkostnad, latens, felfrekvens och detaljer per spann.
AI Engineer. Hamel Husain och Rechats CTO går igenom utvärderingssystemet bakom en verklig AI-produkt: varför generiska standardutvärderingar misslyckas, en skiktad uppsättning assertioner och loggade spår med mänsklig granskning, LLM-bedömare som hålls i linje med en domänexpert samt hur ett fungerande utvärderingssystem möjliggör datakuratering och finjustering. Det är fallstudien från produktion för artikelns argument att utvärderingar är maskiner för att upptäcka regressioner, inte en topplista.
Inspelad i mitten av 2024. De specifika verktygen har utvecklats, men det har inte systemdesignen. Behandla den som en arkitekturreferens, inte som en leverantörsguide, och behåll domänexperten i processen så som föredraget insisterar på.
Se hur ett produktionsteam kombinerar assertioner, mänsklig granskning och LLM-bedömare i lager så att regressioner upptäcks före lansering.
Du bör vara bekväm med grundläggande terminologi för LLM-utvärdering och artikelns modell med en utvärderingsstege.
Senast granskad: 15 juli 2026
Fortsätt längs samma lärstig med nästa kurerade kompletterande video.
9 minuterDu kan navigera bland spår, projekt och datamängder i LangSmith och läsa av tokenkostnad, latens, felfrekvens och detaljer per spann.
75 minuterBygg en första MCP-server och förstå hur verktyg, scheman, prompter, resurser och transporter hänger ihop.
19 minuterFörbättra verktygsdesignen så att agenter väljer rätt åtgärd med rätt parametrar.
Externa kurser som är handplockade och går djupare in i detta ämne.
Emory University Goizueta Business School faculty
The deeper, university-level counterpart to our beginner HubSpot marketing pick — Emory's business-school treatment goes past 'how to prompt' into training generative models for brand-specific output, the purchase-funnel economics of AI-generated content, and a full module of genuine skepticism about when generative AI is and isn't worth using in marketing.
IBM AI Academy
Svaret på ledningens strategiska frågor i den generativa AI-eran. Tre korta kurser direkt riktade till företagsledare – inga tekniska förkunskaper krävs – om var generativ AI skapar värde, hur den styrs ansvarsfullt och hur ett vagt ”vi borde använda AI” omvandlas till ett konkret användningsfall som går att försvara. Betyget är 4,6 baserat på ~700 omdömen. Gå den helst före nästa beslut om AI-budgeten.