Kompletterande videor

Promptteknik för resonemangsmodeller (o3, R1, Claude extended thinking) – kompletterande videor

Artikelns huvudpoäng är att resonemangsmodeller har vänt upp och ned på spelreglerna för promptning: du slutar styra tankekedjan och börjar skriva en tydlig problemspecifikation. De här videorna ger dig både förklaringen och bakgrunden – en tydlig genomgång av vad som gör resonemangsmodeller till en annan typ av modell samt ett kort samtal där personerna bakom o1 beskriver det avgörande ögonblick som gjorde vanliga promptknep överflödiga.

Förstahandsval

27:51
o1 – vad är det som händer? Varför o1 är ett tredje modellparadigm samt 10 saker du kanske inte känner till

AI Explained

Den tydligaste förklaringen utan överdrifter av varför o1 (och i förlängningen o3, R1 och Claude extended thinking) lägger förstärkningsinlärning ovanpå prediktion av nästa token för att belöna korrekta svar i flera steg, och vad det innebär för hur du kommunicerar med modellen. Se den, så slutar artikelns råd ”sluta säga tänk steg för steg, börja skriva specifikationen” att kännas godtyckligt.

Vad du bör få ut av detta: Förstå varför prompter för resonemangsmodeller bör ange problemet, begränsningarna och kriterierna för ett lyckat resultat i stället för att be om en synlig tankekedja.

Titta på eller ha koll på först: Grundläggande erfarenhet av promptning och kännedom om modellnamn som o-serien, Claude extended thinking och R1.

Anteckning från AI Expert: Betrakta terminologin kring o1 som historisk bakgrund. Den användbara lärdomen är skiftet mot tydliga uppgiftsspecifikationer. Aktuella modellnamn, produktbegränsningar och rekommenderade arbetssätt kommer att fortsätta förändras.

Öppna videosidan

Värt att titta på

03:16
Så byggdes OpenAI o1

OpenAI

Tre minuter med o1-teamet, som beskriver ögonblicket då modellen började ifrågasätta sitt eget resonemang under RL-träningen. Den är användbar som förstahandskälla till artikelns påstående att tankekedjan nu äger rum inuti modellen, inte i din prompt.

Vad du bör få ut av detta: Ta del av det ursprungliga produkt- och forskningsperspektiv som gjorde resonemangsmodeller annorlunda än vanliga chattmodeller.

Titta på eller ha koll på först: Se förstahandsvalet först eller läs avsnittet om resonemangsmodeller i den tillhörande artikeln.

Anteckning från AI Expert: Behåll den här som historiskt källmaterial, inte som aktuell vägledning för implementation. Den förklarar varför kategorin uppstod, men produktionsbeslut bör baseras på det aktuella modellutbudet och den aktuella API-dokumentationen.

Öppna videosidan