Instrumentation et évaluation des LLM

154 minutesAvancéConcepteurHamel HusainIA pour les entreprises

Hamel Husain. Hamel Husain, Eugene Yan, Brian Bischof, Harrison Chase et Shreya Shankar travaillent sur le traçage, l’analyse des journaux, les LLM utilisés comme juges et le flux d’examen de véritables données de production. Consacrez à cette vidéo la même attention qu’à un long podcast : c’est sur YouTube l’analyse la plus approfondie de la thèse « examinez vos traces » défendue dans l’article.

Note d’AI Expert

Ces deux heures et demie n’ont attiré que peu de vues, mais sont conservées délibérément : il n’existe aucune analyse approfondie comparable de l’évaluation pilotée par les traces. Regardez-la comme un long podcast.

Ce que vous en retirerez

Relier le traçage, l’évaluation, les retours et l’examen de la production dans une boucle opérationnelle pour les systèmes LLM.

À voir ou à connaître au préalable

Expérience avec les modèles de langage en production — elle suppose que vous avez des traces et des journaux réels à analyser.

Dernière révision : 18 mai 2026

À regarder ensuite

Continuez dans le même parcours d’apprentissage avec les prochaines vidéos d’accompagnement sélectionnées.