27:51AI Explained
Den tydligaste förklaringen utan överdrifter av varför o1 (och i förlängningen o3, R1 och Claude extended thinking) lägger förstärkningsinlärning ovanpå prediktion av nästa token för att belöna korrekta svar i flera steg, och vad det innebär för hur du kommunicerar med modellen. Se den, så slutar artikelns råd ”sluta säga tänk steg för steg, börja skriva specifikationen” att kännas godtyckligt.
Vad du bör få ut av detta: Förstå varför prompter för resonemangsmodeller bör ange problemet, begränsningarna och kriterierna för ett lyckat resultat i stället för att be om en synlig tankekedja.
Titta på eller ha koll på först: Grundläggande erfarenhet av promptning och kännedom om modellnamn som o-serien, Claude extended thinking och R1.
Anteckning från AI Expert: Betrakta terminologin kring o1 som historisk bakgrund. Den användbara lärdomen är skiftet mot tydliga uppgiftsspecifikationer. Aktuella modellnamn, produktbegränsningar och rekommenderade arbetssätt kommer att fortsätta förändras.
