32 minutesServir rapidement des LLM avec vLLM et PagedAttention
Comprendre pourquoi le moteur d'inférence, le traitement par lots et la mémoire du cache KV dominent l'économie d'une infrastructure auto-hébergée.
OpenAI. Cette session officielle d'OpenAI détaille le seuil de 1 024 tokens, l'exigence de stabilité du préfixe, les fortes remises liées à la mise en cache audio en temps réel — consultez la page tarifaire actuelle pour connaître le taux exact — et l'effet des longues entrées sur le délai avant le premier token. Elle aide à estimer l'effort technique nécessaire pour exploiter le cache de façon fiable avec vos prompts de production.
Son audience est nettement inférieure à notre seuil, mais il s'agit de la présentation officielle approfondie. Le seuil de 1 024 tokens et la stabilité des préfixes déterminent si la mise en cache fonctionnera ; les tarifs actuels figurent sur la page dédiée.
Utilisez la mise en cache des prompts uniquement lorsque les préfixes stables, le comportement de latence et de coût correspondent à la charge de travail.
Utiliser déjà des prompts avec l'API OpenAI ; la session porte sur une exploitation fiable du cache en production.
Dernière révision : 18 mai 2026
Continuez dans le même parcours d’apprentissage avec les prochaines vidéos d’accompagnement sélectionnées.
32 minutesComprendre pourquoi le moteur d'inférence, le traitement par lots et la mémoire du cache KV dominent l'économie d'une infrastructure auto-hébergée.
34 minutesÉvaluer la tarification d'un produit IA et la spécialisation autour de résultats mesurables plutôt que du nombre d'utilisateurs.
6 minutesIdentifier l'architecture centrale d'un agent vocal et les points de défaillance qui affectent la confiance des clients lors d'appels réels.
Des cours externes sélectionnés pour approfondir ce sujet.
Emory University Goizueta Business School faculty
The deeper, university-level counterpart to our beginner HubSpot marketing pick — Emory's business-school treatment goes past 'how to prompt' into training generative models for brand-specific output, the purchase-funnel economics of AI-generated content, and a full module of genuine skepticism about when generative AI is and isn't worth using in marketing.
IBM AI Academy
Une réponse adaptée à l'ère de l'IA générative aux questions stratégiques des dirigeants. Trois cours courts, sans prérequis technique, expliquent où l'IA générative crée de la valeur, comment la gouverner de façon responsable et comment transformer une vague intention d'« utiliser l'IA » en un cas d'usage concret et défendable. Note de 4,6 sur environ 700 avis. À suivre avant la prochaine décision budgétaire liée à l'IA.