Prompts avancés
Prompts de raisonnement, bibliothèques réutilisables, conception du contexte et couches de prompts en production.
22 contenus (8 articles · 14 vidéos)
Commencez ici
Quelques bons contenus pour débuter avant de parcourir l’ensemble du flux.
11 min de lectureCréer des bibliothèques de prompts réutilisables : des extraits à des modèles partagés
Lorsqu'une même tâche assistée par l'IA se répète, une bibliothèque de prompts peut rendre le flux de travail plus facile à reproduire et à évaluer. Une méthode pratique pour consigner, tester, versionner et partager des modèles.
Intermédiaire
10 min de lectureChoisir et interroger les modèles de raisonnement
Les réglages de raisonnement modifient la qualité, la latence, le coût et parfois le comportement face aux prompts. Un guide pratique pour les choisir par l'évaluation plutôt que par les idées reçues.
Intermédiaire
12 min de lectureIngénierie du contexte : gérer des fenêtres d’un million de tokens sans dégradation
Les fenêtres de contexte d’un million de tokens existent, mais la qualité se dégrade bien avant cette limite. L’ingénierie du contexte consiste à les utiliser efficacement : quoi inclure, résumer ou rechercher à la demande, et quels schémas préservent la qualité lorsque le contexte augmente.
AvancéPlus de contenus sur ce thème
10 min de lectureChaîne de pensée, autocritique, arbre de pensées — quand utiliser chaque technique
Trois techniques de raisonnement qui améliorent réellement les résultats de l'IA sur les problèmes difficiles, avec une analyse de leur rapport coût-bénéfice, des prompts concrets, des comparaisons directes et les pièges propres aux modèles de raisonnement modernes.
Intermédiaire
12 min de lectureChoisir entre le prompting, le RAG et le fine-tuning (et quand les combiner)
Le prompting, le RAG et le fine-tuning sont les trois principaux leviers permettant d’adapter un LLM à votre problème. Chacun convient à certaines situations et non à d’autres. Voici un cadre de décision, leurs coûts réels et les architectures de production où leur combinaison excelle.
Avancé
12 min de lectureConception de prompts en production : couches système, développeur et utilisateur
Un modèle de gouvernance pour séparer les instructions fiables, les données d'exécution et l'entrée utilisateur, puis versionner, évaluer, déployer et observer les prompts en fonction du risque.
Avancé
7 min de lectureChoisir le bon modèle selon la tâche : aide-mémoire 2026
Quel modèle choisir selon le type de tâche ? GPT, Claude, Gemini, variantes de raisonnement et options à poids ouverts, avec des règles de décision et des exemples de mi-2026 plutôt qu'un classement intemporel.
Débutant
13 min de lectureSorties structurées et appels de fonctions : les schémas adaptés à la production
Les sorties structurées et les appels de fonctions permettent de passer d’un « LLM qui génère du texte » à un « système qui exécute des tâches ». En production, les schémas, la gestion des erreurs, l’idempotence et la dégradation progressive comptent davantage que le seul mode JSON.
Avancé
29 minutesArbre de pensées : résolution délibérée de problèmes avec de grands modèles de langage (analyse complète de l’article)
Yannic Kilcher. Yannic analyse l’article original de Princeton/DeepMind sur l’arbre de pensées — la boucle génération-évaluation-élagage-retour arrière, la raison pour laquelle elle fait passer la précision au jeu de 24 de 4 % à 74 %, et le point à partir duquel la technique ne justifie plus un coût en tokens multiplié par 10. La vidéo est utile précisément parce qu’elle vous oblige à considérer ToT comme un algorithme de recherche, et non comme un préfixe de prompt magique.
Intermédiaire
25 minutesLes fondamentaux du prompting
Anthropic. Deux membres de l’équipe Applied AI d’Anthropic construisent en direct un prompt destiné à un cas réel, en ajoutant progressivement un rôle, des sections structurées et des étapes de réflexion explicites. C’est sur YouTube la démonstration la plus crédible de l’utilisation de la chaîne de pensée sans en faire un rituel. Elle illustre concrètement le message de l’article : cessez de coller « réfléchissons étape par étape » dans tous vos prompts.
Intermédiaire
22 minutesIngénierie du contexte pour les agents
LangChain. Lance Martin présente le cadre « écrire, sélectionner, compresser, isoler », avec des exemples concrets : quand résumer l'historique des actions, quand externaliser l'état dans des fichiers et quand lancer des sous-agents uniquement pour préserver le contexte de l'agent parent. Cette approche correspond presque directement à la section de l'article consacrée à la gestion pratique des fenêtres d'un million de tokens.
Avancé
8 minutesDégradation du contexte : Comment l'augmentation des tokens d'entrée affecte les performances des grands modèles de langage
Chroma. Kelly Hong présente les recherches de Chroma sur 18 modèles : pourquoi les scores aux tests de « l'aiguille dans une botte de foin » sont trompeurs, comment les performances diminuent face à l'ambiguïté et aux éléments parasites, et pourquoi même de simples tâches de répétition de chaînes se dégradent au-delà de 500 tokens. Courte et étayée par des données, cette vidéo montre précisément le risque qu'il faut prendre au sérieux avant d'aborder les solutions techniques de l'article.
Avancé
3 minutesLa création d’OpenAI o1
OpenAI. Cette vidéo de trois minutes consigne la manière dont l'équipe OpenAI présentait o1 lors de son lancement. Elle aide à comprendre l'histoire de la catégorie, mais n'établit ni le fonctionnement interne des modèles actuels ni le meilleur schéma de prompt pour un autre fournisseur ou une autre tâche.
Intermédiaire
28 minuteso1 : que se passe-t-il ? Pourquoi o1 représente un troisième paradigme de modèle, plus dix faits méconnus
AI Explained. La vidéo offre une explication indépendante du cadrage initial de o1 et de ses implications pour les prompts. C'est un contexte historique utile, mais ses affirmations sur o1 ne doivent pas être étendues automatiquement aux modèles OpenAI ultérieurs, à R1, aux modes de réflexion de Claude ou à d'autres fournisseurs.
Intermédiaire
9 minutesRAG ou fine-tuning
IBM Technology. Cette vidéo se concentre sur les deux techniques que les équipes confondent le plus souvent. Elle approfondit la fraîcheur des données, l’attribution des sources et l’avantage de vitesse à l’inférence que peut apporter le fine-tuning. Elle mérite d’être regardée si vous cherchez précisément à déconseiller un projet de fine-tuning inutile.
Avancé
13 minutesRAG, fine-tuning ou ingénierie des prompts : optimiser les modèles d’IA
IBM Technology. Cette présentation claire au tableau blanc compare les trois techniques et leurs coûts respectifs — latence de récupération, calcul nécessaire à l’entraînement, oubli catastrophique et limites des solutions fondées uniquement sur les prompts — ainsi que les combinaisons réellement pertinentes en production. L’exemple final d’un système d’IA juridique utilisant les trois correspond presque exactement à l’argument « quand les combiner » de l’article.
Avancé
77 minutesIngénierie de prompts en IA : une plongée approfondie
Anthropic. Quatre spécialistes des prompts chez Anthropic — issus de la recherche, de l’alignement, de l’IA appliquée et des relations avec les développeurs — décrivent longuement leur travail quotidien : comment ils révisent des prompts sous pression, comment ils abordent l’« honnêteté » des instructions et dans quels cas les structures XML sont utiles ou non. Le modèle en couches de l’article correspond directement à leur façon de décrire le travail ; c’est le meilleur moyen d’entendre ce modèle mental formulé à voix haute.
Avancé
25 minutesInitiation aux prompts | Code avec Claude
Anthropic. L’équipe Applied AI d’Anthropic construit en direct un prompt consacré à des demandes d’indemnisation. Elle part d’une instruction vague et l’améliore jusqu’à obtenir un résultat qu’un développeur pourrait réellement livrer, en montrant les révisions des couches système et développeur décrites dans l’article. Regardez cette vidéo avant de relire la liste de contrôle de l’article sur les exemples, la structure des sorties et le traitement des refus.
Avancé
10 minutesLe meilleur prompt ChatGPT que j'ai jamais créé — j'ai passé 2 mois à le peaufiner pour écrire des prompts
Lawton Learns. La vidéo présente un méta-prompt C.R.A.F.T. — Context, Role, Action, Format et Target audience. C'est un candidat utile pour tester le comportement d'un prompt générateur de prompts, mais la cohérence, l'exactitude et l'adéquation de ses sorties aux cas d'une équipe ne sont pas garanties.
Intermédiaire
20 minutesLe cours de neuf heures de Google sur l’ingénierie des prompts d’IA, condensé en 20 minutes
Tina Huang. Tina présente un cadre en cinq parties — tâche, contexte, références, évaluation et itération — ainsi que quatre techniques d'itération. Ces éléments peuvent aider à rédiger un schéma candidat, mais les exemples d'agents et de chaîne de pensée reflètent l'époque et le contexte du cours. Testez tout schéma extrait sur des cas représentatifs avant de l'ajouter à une bibliothèque approuvée.
Intermédiaire
41 minutesOpenAI DevDay 2024 | Sorties structurées pour des applications fiables
OpenAI. La vidéo présente `strict: true`, sa différence par rapport à l’ancien mode JSON, le traitement des refus et la manière dont les appels de fonctions s’articulent avec les schémas de format de réponse. Elle est particulièrement utile parce qu’elle décrit le contrat fourni par l’API, sur lequel reposent les schémas de production de l’article.
Avancé
18 minutesPydantic est tout ce dont vous avez besoin : Jason Liu
AI Engineer. Cette présentation a cristallisé le modèle moderne « définir un modèle Pydantic, le transmettre au LLM et laisser la validation faire le reste ». Elle donne des exemples concrets d’objets imbriqués, de validateurs qui détectent les URL hallucinées et de chaîne de pensée représentée par un champ typé. Regardez-la avant de relire la section de l’article sur les validateurs : vous reconnaîtrez l’origine de ses règles de nouvelle tentative et de refus.
Avancé