Build Hour : Mise en cache des prompts

56 minutesAvancéConcepteurOpenAIIA pour les entreprises

OpenAI. Cette session officielle d'OpenAI détaille le seuil de 1 024 tokens, l'exigence de stabilité du préfixe, les fortes remises liées à la mise en cache audio en temps réel — consultez la page tarifaire actuelle pour connaître le taux exact — et l'effet des longues entrées sur le délai avant le premier token. Elle aide à estimer l'effort technique nécessaire pour exploiter le cache de façon fiable avec vos prompts de production.

Note d’AI Expert

Son audience est nettement inférieure à notre seuil, mais il s'agit de la présentation officielle approfondie. Le seuil de 1 024 tokens et la stabilité des préfixes déterminent si la mise en cache fonctionnera ; les tarifs actuels figurent sur la page dédiée.

Ce que vous en retirerez

Utilisez la mise en cache des prompts uniquement lorsque les préfixes stables, le comportement de latence et de coût correspondent à la charge de travail.

À voir ou à connaître au préalable

Utiliser déjà des prompts avec l'API OpenAI ; la session porte sur une exploitation fiable du cache en production.

Dernière révision : 18 mai 2026

À regarder ensuite

Continuez dans le même parcours d’apprentissage avec les prochaines vidéos d’accompagnement sélectionnées.