Thème

Évaluations, observabilité et qualité

Mesurez le comportement de l’IA, détectez les régressions, suivez les coûts et la latence, et améliorez continuellement les flux de travail.

12 contenus (5 articles · 7 vidéos)

Commencez ici

Quelques bons contenus pour débuter avant de parcourir l’ensemble du flux.

Plus de contenus sur ce thème

Vidéo

Le paysage des agents – enseignements tirés de leur mise en production

Le paysage des agents – enseignements tirés de leur mise en production

Avancé
10 min de lecture
Article

Modes de défaillance de l'IA en production : ce qui échoue après la démonstration

Les systèmes d'IA échouent généralement de manière prévisible : hallucinations, contexte obsolète, complaisance, injection de consignes, usage non sûr des outils, dérive de schéma et mécanismes de repli insuffisants. Voici un registre des modes de défaillance pour les équipes qui mettent de véritables processus en production.

Avancé
11 min de lecture
Article

Segmentation, reclassement et recherche hybride : rendre le RAG réellement efficace

La plupart des systèmes RAG fonctionnent mal à cause de trois erreurs. Voici un guide pratique pour segmenter les documents, reclasser les résultats et combiner recherche par mots-clés et recherche sémantique, sans devenir ingénieur de recherche.

Intermédiaire
Vidéo

Pourquoi les évaluations d’IA sont la nouvelle compétence incontournable des concepteurs de produits | Hamel Husain et Shreya Shankar

Pourquoi les évaluations d’IA sont la nouvelle compétence incontournable des concepteurs de produits | Hamel Husain et Shreya Shankar

Intermédiaire
Vidéo

Évaluer des prompts dans la console Anthropic

Évaluer des prompts dans la console Anthropic

Intermédiaire
Vidéo

Comment mettre systématiquement en place des évaluations de LLM (métriques, tests unitaires, LLM utilisé comme juge)

Comment mettre systématiquement en place des évaluations de LLM (métriques, tests unitaires, LLM utilisé comme juge)

Avancé
Vidéo

Comment construire des systèmes d'évaluation LLM spécifiques à un domaine : Hamel Husain et Emil Sedgh

Comment construire des systèmes d'évaluation LLM spécifiques à un domaine : Hamel Husain et Emil Sedgh

Avancé
Vidéo

LangSmith en 10 minutes

LangSmith en 10 minutes

Avancé
Vidéo

Instrumentation et évaluation des LLM

Instrumentation et évaluation des LLM

Avancé