Djupdykning i LLM:er som ChatGPT

211 minuterAvanceradByggareAndrej KarpathyChatGPT och LLM:er

Andrej Karpathy. Det här är YouTubes tydligaste heltäckande förklaring av vad en LLM faktiskt är – förträning, tokenisering, SFT, RLHF, resonemangsträning med förstärkningsinlärning, verktygsanvändning och hallucinationer – på den detaljnivå en ingenjör behöver för att kunna resonera om modellavvägningar. Se den en gång, så slutar artikelns beslut mellan ”modeller i GPT-klassen, modeller med öppna vikter och resonemangsmodeller” att kännas som varumärkesval och börjar kännas som val mellan träningsmetoder.

Anteckning från AI Expert

Modellnamn, priser och funktioner förändras snabbt. Använd videon för beslutsmönstret och verifiera sedan modellens aktuella beteende innan du börjar använda den.

Vad du bör få ut av detta

Förstå den moderna LLM-stacken tillräckligt väl för att kunna resonera om token, träning, verktyg och fel.

Titta på eller ha koll på först

En teknisk bakgrund är till hjälp. Inga förkunskaper inom maskininlärning krävs, men avsätt tid för den tre och en halv timmar långa videon.

Senast granskad: 18 maj 2026

Se nästa

Fortsätt längs samma lärstig med nästa kurerade kompletterande video.