3:31:24Andrej Karpathy
Det här är YouTubes tydligaste heltäckande förklaring av vad en LLM faktiskt är – förträning, tokenisering, SFT, RLHF, resonemangsträning med förstärkningsinlärning, verktygsanvändning och hallucinationer – på den detaljnivå en ingenjör behöver för att kunna resonera om modellavvägningar. Se den en gång, så slutar artikelns beslut mellan ”modeller i GPT-klassen, modeller med öppna vikter och resonemangsmodeller” att kännas som varumärkesval och börjar kännas som val mellan träningsmetoder.
Vad du bör få ut av detta: Förstå den moderna LLM-stacken tillräckligt väl för att kunna resonera om token, träning, verktyg och fel.
Titta på eller ha koll på först: En teknisk bakgrund är till hjälp. Inga förkunskaper inom maskininlärning krävs, men avsätt tid för den tre och en halv timmar långa videon.
Anteckning från AI Expert: Modellnamn, priser och funktioner förändras snabbt. Använd videon för beslutsmönstret och verifiera sedan modellens aktuella beteende innan du börjar använda den.
