1:46:33Lenny's Podcast
Hamel Husain och Shreya Shankar går igenom hela arbetsflödet för utvärderingar med en verklig AI-assistent för fastighetsförvaltning – granskar spårningar, kodar fel öppet och axialt, avgör när de ska sluta, bygger en LLM som bedömare och validerar den mot mänsklig bedömning. Det här är ett av få längre samtal som verkligen riktar sig till produktchefer och teamledare snarare än ML-utvecklare, och det tar upp samma rytm på ”30 minuter i veckan efter konfigureringen” som artikeln rekommenderar.
Vad du bör få ut av detta: Lär dig utvärderingsloopen för produktutvecklare: granska spårningar, märk fel, definiera kriterier, testa ändringar och jämför med mänsklig bedömning.
Titta på eller ha koll på först: Ha minst ett AI-arbetsflöde där kvaliteten kan bli bättre eller sämre med tiden.
Anteckning från AI Expert: Det här är fortfarande en av de bästa förklaringarna av utvärderingar för icke-utvecklare eftersom den fokuserar på arbetsflödesdisciplin snarare än ett specifikt verktyg. Behåll metoden och välj sedan verktyg som passar dina integritets- och observerbarhetskrav.
