Vidéos complémentaires

Choisir le bon modèle selon la tâche — vidéos complémentaires

L'article sert d'aide-mémoire décisionnel : quel fournisseur, quelle gamme et quel réglage de « raisonnement » choisir pour chaque tâche. La vidéo ci-dessous montre une personne passant réellement d'un modèle à l'autre. Vous comprendrez ainsi pourquoi un praticien expérimenté en privilégie un plutôt qu'un autre selon le besoin du moment.

Choix principal

2:11:12
Comment j'utilise les LLM

Andrej Karpathy

Karpathy consacre des chapitres entiers au choix du modèle et de la gamme tarifaire, puis aux modèles de raisonnement et aux situations qui les justifient. Il alterne ensuite entre ChatGPT, Claude, Gemini, Grok et Perplexity pendant toute la démonstration. C'est ce qui se rapproche le plus d'une application en direct de l'aide-mémoire de l'article par une personne ayant des critères affirmés sur la valeur de chaque gamme.

Ce que vous en retirerez: Répartir les tâches entre des outils rapides, économiques, capables d'un raisonnement approfondi ou ancrés dans des sources, au lieu d'employer un seul modèle pour tout.

À voir ou à connaître au préalable: Savoir utiliser au moins un chatbot courant et comparer plusieurs réponses à une même tâche.

Note d’AI Expert: Les habitudes de sélection sont précieuses, mais les noms précis des modèles, les tarifs, les limites de contexte et les classements évoluent. Reproduisez la comparaison sur vos propres tâches avant de normaliser une recommandation pour votre équipe.

Ouvrir la page vidéo

À voir également

16:50
La nouvelle IA la plus intelligente : Claude 3 – Testé contre Gemini 1.5 + GPT-4

AI Explained

La vidéo est antérieure à l'article — mars 2024 —, mais sa méthode reste utile : un évaluateur rigoureux soumet trois modèles de pointe aux mêmes tâches difficiles — reconnaissance optique de caractères, théorie de l'esprit, respect des instructions et mathématiques — puis montre précisément les limites de chacun. Les noms des modèles ont vieilli ; le cadre de comparaison, non.

Ce que vous en retirerez: Découvrir une méthode structurée et réutilisable pour déterminer quel modèle convient suffisamment bien à une tâche.

À voir ou à connaître au préalable: Savoir que Claude 3, Gemini 1.5 et GPT-4 ne constituent plus la référence de pointe.

Note d’AI Expert: Considérez cette vidéo comme une méthode de test, et non comme un classement actuel. Les vainqueurs appartiennent au passé ; l'intérêt consiste à exécuter les mêmes exemples, à examiner les modes d'échec et à se méfier des affirmations vagues sur le « meilleur modèle ».

Ouvrir la page vidéo