Kompletterande videor

Välj rätt modell för uppgiften – kompletterande videor

Artikeln är en snabbguide för beslut: vilken leverantör, vilken nivå och vilket ”tänkande” läge som passar vilken uppgift. Videon nedan visar någon som faktiskt växlar mellan modellerna på skärmen, så att du kan se varför en yrkesverksam användare väljer den ena framför den andra i stunden.

Förstahandsval

2:11:12
Så använder jag LLM:er

Andrej Karpathy

Karpathy ägnar särskilda kapitel åt ”Var medveten om vilken modell du använder och prisnivåerna” och ”Tänkande modeller och när de ska användas”. Under resten av genomgången fortsätter han sedan att växla mellan ChatGPT, Claude, Gemini, Grok och Perplexity. Det är det närmaste du kommer att se artikelns snabbguide tillämpas i realtid av någon med tydliga uppfattningar om när varje nivå är värd sitt pris.

Vad du bör få ut av detta: Lär dig fördela arbetet mellan snabba, billiga och djupresonerande verktyg samt verktyg som grundar svaren i källor, i stället för att använda en modell till allt.

Titta på eller ha koll på först: Du bör känna dig bekväm med att använda minst en vanlig chattbot och jämföra resultat från samma uppgift.

Anteckning från AI Expert: Vanorna för modellval är värdefulla, men exakta modellnamn, priser, kontextgränser och rankningar är inte beständiga. Gör om jämförelsen med dina egna uppgifter innan du standardiserar en rekommendation för ett team.

Öppna videosidan

Värt att titta på

16:50
Den nya, smartaste AI:n: Claude 3 – testad mot Gemini 1.5 och GPT-4

AI Explained

Videon är äldre än artikeln (mars 2024), men det är metodiken som är användbar: en och samma noggranna granskare kör samma svåra uppgifter – OCR, mentalisering, instruktionsföljning och matematik – genom tre ledande modeller sida vid sida och visar exakt var var och en brister. Modellnamnen är inaktuella, men ramverket för att jämföra modeller är det inte.

Vad du bör få ut av detta: Se en strukturerad jämförelsemetod som du kan återanvända när du avgör vilken modell som är tillräckligt bra för en uppgift.

Titta på eller ha koll på först: Du behöver veta att Claude 3, Gemini 1.5 och GPT-4 inte längre utgör den ledande baslinjen.

Anteckning från AI Expert: Se den här videon som en metod för testning, inte som en aktuell rankning. De konkreta vinnarna är historiska. Det användbara är att köra samma exempel, undersöka fellägen och stå emot vaga påståenden om ”den bästa modellen”.

Öppna videosidan