Vidéos complémentaires

Agents de navigateur et pilotage d’ordinateur — vidéos complémentaires

L’article présente les agents de navigateur comme une capacité réelle mais limitée : utiles pour des tâches web répétitives et bien délimitées, mais fragiles dès qu’il faut faire preuve de jugement ou franchir une authentification en direct. Les vidéos ci-dessous le montrent en pratique — d’abord Anthropic avec Claude exécutant une petite tâche dans plusieurs applications directement sur l’ordinateur, puis la démonstration de lancement d’Operator par OpenAI sur de véritables sites, avec erreurs, confirmations et reprises en main.

Choix principal

02:04
Claude | Utilisation de l'ordinateur pour orchestrer des tâches

Anthropic

Cette démonstration de deux minutes d’Anthropic montre Claude planifier une petite tâche dans plusieurs applications — effectuer une recherche sur le web, consulter Maps et créer une invitation dans le calendrier — en contrôlant directement l’ordinateur. Elle offre un contraste utile avec le modèle limité au navigateur distant dans la démonstration d’Operator ci-dessous et illustre concrètement l’idée de l’article : les agents capables de contrôler un ordinateur conviennent mieux aux tâches courtes et bien délimitées qu’aux travaux ouverts.

Ce que vous en retirerez: Comparer le comportement d’un agent qui contrôle directement l’ordinateur à celui d’un agent limité au navigateur.

À voir ou à connaître au préalable: Lire d'abord la section de sécurité de l'article complémentaire ; la démonstration Operator ci-dessous ajoute le point de vue côté navigateur.

Note d’AI Expert: Il s’agit d’une courte démonstration de capacité, pas d’une recette de déploiement. Ne la transposez pas en production sans environnement isolé, comptes séparés, journalisation et approbation explicite de l’utilisateur pour les actions qui modifient l’état.

Ouvrir la page vidéo

À voir également

23:51
Introduction à Operator et aux agents

OpenAI

Dans cette véritable démonstration de lancement d’Operator, l’équipe réserve une table au restaurant, commande des courses, achète des billets pour un événement et laisse Operator se retrouver bloqué par une redirection ou rendre la main lorsqu’il atteint un écran de connexion. C’est l’illustration la plus claire de l’expérience concrète d’un agent de navigateur — boucle capture d’écran-clic, confirmations avant les actions qui modifient l’état et garde-fous contre l’injection de prompt. L’article cherche précisément à donner une attente réaliste de cette expérience.

Ce que vous en retirerez: Identifier la boucle d'action de l'agent navigateur, là où elle aide et là où une confirmation humaine est toujours nécessaire.

À voir ou à connaître au préalable: Compréhension de base des agents et de la raison pour laquelle les tâches web en temps réel sont plus difficiles que la génération de texte.

Note d’AI Expert: Les noms et la disponibilité des produits peuvent changer. Operator, initialement proposé comme produit autonome, a été intégré au mode agent de ChatGPT en 2025 : regardez cette vidéo pour ses modèles d’interaction, pas pour le produit. La leçon durable est le modèle de contrôle — tâches ciblées, état visible, confirmations, procédures de reprise en main et défenses contre l’injection de prompt.

Ouvrir la page vidéo