Den nye, klogeste AI: Claude 3 – testet mod Gemini 1.5 + GPT-4

17 minutterBegynderPraktikerAI ExplainedChatGPT & LLMs

AI Explained. Ældre end artiklen (marts 2024), men metoden er det nyttige: én omhyggelig anmelder kører de samme svære opgaver — OCR, theory of mind, instruktionsfølgning, matematik — gennem tre frontier-modeller side om side og viser præcis, hvor hver af dem knækker. Modelnavnene er forældede; rammen for at sammenligne modeller er det ikke.

Bemærkning fra AI Expert

Behandl den som en video om testmetode, ikke en aktuel rangering. De konkrete vindere er historiske; det nyttige er at køre de samme eksempler, tjekke fejltilstande og modstå vage krav om "den bedste model".

Hvad du bør få ud af dette

Se en struktureret sammenligningsmetode, du kan genbruge, når du beslutter, hvilken model der er god nok til en opgave.

Forudsætninger

Vid, at Claude 3, Gemini 1.5 og GPT-4 ikke længere er frontier-baseline.

Senest gennemgået: 18. maj 2026

Se næste

Fortsæt ad den samme læringsvej med de næste kuraterede videoer.