Partager des images avec l'IA : ce que vous pouvez téléverser (et ce que vous devriez éviter)
Découvrir l’IA6 min de lectureChatGPT & LLMs

Partager des images avec l'IA : ce que vous pouvez téléverser (et ce que vous devriez éviter)

L'IA moderne peut lire des photos, des graphiques, des captures d'écran et des textes manuscrits presque aussi facilement que du texte numérique. Voici ce qui fonctionne, ce qui ne fonctionne pas et la vérification de confidentialité à effectuer en trente secondes avant tout téléversement.

Ce que vous saurez faire

Le téléversement d'images est l'une des fonctions d'IA les plus utiles, mais aussi l'une des moins utilisées. Photos de reçus, captures d'écran de tableaux de bord, graphiques dans des PDF ou notes manuscrites : le modèle peut tout lire rapidement et efficacement. Effectuez simplement d'abord la vérification de confidentialité de trente secondes.

AI Expert TeamPublié: 15 mai 2026
Enregistré uniquement dans ce navigateur.
Dans cet article

En 2026, tous les principaux assistants d’IA — ChatGPT, Claude, Gemini et Copilot — peuvent analyser des images. Vous téléversez une photo, une capture d’écran, un graphique, un document numérisé ou un texte manuscrit, puis posez une question à son sujet. Le modèle l’analyse et répond.

Cette fonction est bien plus puissante que ne l’imaginent la plupart des débutants. C’est aussi celle qui échappe le plus facilement à vos réflexes de confidentialité, car téléverser une photo semble différent de coller du texte. Cet article présente à la fois les cas d’usage où l’analyse d’images change réellement la donne et la courte vérification à effectuer avant de cliquer sur « Envoyer ».

Comment télécharger une image

Dans chaque grand assistant d’IA, le bouton de téléversement prend la forme d’un trombone ou du signe « + » près de la zone de saisie. Les applications mobiles permettent de prendre directement une photo. Sur ordinateur, vous pouvez coller une image depuis le presse-papiers. Les formats pris en charge sont JPEG, PNG et WEBP, ainsi que généralement HEIC et PDF. La plupart des applications acceptent aussi les PDF de plusieurs pages et les captures d’écran de votre téléphone.

Un détail utile : vous pouvez téléverser une image et saisir un prompt en même temps. Le modèle utilise les deux. Écrire simplement « Qu’est-ce que c’est ? » fonctionne, mais « Quel est le contenu de la troisième puce de cette diapositive ? » donne un bien meilleur résultat.

Les cas d’usage où cette fonction fait la différence

Quelques scénarios de téléchargement d’images sont tellement supérieurs à l’alternative qu’une fois que vous les avez essayés, vous ne revenez plus en arrière.

Décoder les graphiques de documents longs. Les rapports annuels, articles de recherche, études de marché et présentations regorgent de graphiques dont l’analyse demande un réel effort. Capturez le graphique, téléversez-le et demandez : « Que montre ce graphique ? Quelle est la donnée la plus surprenante et qu’implique-t-elle pour une personne exerçant [votre rôle] ? » Le modèle sait bien en extraire le sens général et les implications, ce qui correspond généralement à votre besoin.

Identifier des objets. Une plante de votre jardin, un équipement posé sur un bureau, un ingrédient inconnu, un poisson au marché, ou encore la marque et le modèle d’un ancien appareil. Téléversez l’image et posez la question. Le modèle proposera une estimation plausible et, si vous le lui demandez, d’autres possibilités.

Lire des notes manuscrites. Notes de réunion sur un tableau blanc, lettre manuscrite, recette griffonnée sur une fiche ou photographies d’un cahier : les modèles modernes déchiffrent étonnamment bien les écritures difficiles. Une seule demande — « Transformez ce contenu en une liste structurée d’actions » — suffit ensuite pour le mettre au propre.

Décoder des captures d’écran. Un message d’erreur déroutant, une feuille de calcul au comportement inattendu, un extrait de code dans une présentation ou un graphique difficile à copier depuis un fil Slack : faites une capture, téléversez-la et posez votre question. C’est plus rapide que de copier puis de remettre en forme le contenu.

Lire les reçus et les factures. Surtout pendant les voyages d’affaires. Photographiez le reçu, demandez au modèle d’extraire la date, le fournisseur, le total, la devise, et la catégorie dans un format propre. Vous pouvez ensuite coller le résultat dans votre outil de dépenses. Pour une pile de reçus, faites-le par lots.

Obtenir des commentaires sur le style et la mise en page. Téléversez une diapositive, un CV, une affiche ou la capture d’écran d’une page d’accueil, puis demandez : « Quel élément le lecteur voit-il en premier ? Que pourrait-on supprimer et quelle hiérarchie visuelle manque-t-il ? » C’est l’un des usages les plus efficaces pour toute personne travaillant avec des documents et des présentations.

Vérifier des traductions. Photographiez un panneau ou un menu dans un pays étranger, puis demandez-en la traduction et le contexte culturel. Pour un texte de plus de quelques mots, cette méthode est plus rapide et plus fiable qu’une application de traduction sur téléphone.

Cuisiner avec ce que vous avez. Ouvrez le réfrigérateur, photographiez son contenu, téléchargez, demandez “qu’est-ce que je peux cuisiner pour le dîner en 30 minutes à partir de ce que vous pouvez voir ici ?” Le modèle est bon à ce sujet et vous surprendra.

Un avantage sous-estimé spécifique : les tableaux et les listes dans les captures d’écran

Si vous avez déjà dû extraire les données d’un tableau contenu dans une image ou un PDF dont le texte ne pouvait pas être copié, vous savez à quel point l’exercice est frustrant. L’IA moderne simplifie considérablement cette tâche :

Voici une capture d’écran d’un tableau. Extrayez-la en un CSV propre. La première colonne est la ligne d’en-tête. Marquez toute valeur dont vous n’êtes pas sûr avec [?].

Vous pouvez ensuite coller le CSV dans Excel ou Google Sheets. La première fois que vous faites cela sur un tableau complexe, le temps gagné est significatif. L’instruction “marquer les valeurs incertaines” est importante — sans elle, les erreurs de reconnaissance optique passent silencieusement.

Les limites du téléversement d’images

Une courte liste honnête des endroits où le modèle est peu fiable :

Extraction précise de texte à partir d’images de faible qualité. Des photos légèrement floues, des documents à un angle étrange, du texte très petit. Le modèle fera un effort confiant, mais la précision diminue. Vérifiez toujours si la précision est importante.

Identifier des individus spécifiques nommés. La plupart des modèles ne reconnaîtront pas une personne spécifique dans une photo, à la fois pour des raisons de précision et de confidentialité. Ils décriront ce qu’ils voient.

Compter et mesurer. « Combien de personnes apparaissent sur cette photo ? » ou « Quelle est la hauteur de cet objet ? » Les modèles sont étonnamment peu fiables pour les comptages et les mesures précis. Ils produiront une estimation plausible. Vérifiez la réponse si elle a de l’importance.

Lire des scanners médicaux, des radiographies, des IRM ou d’autres images cliniques. Les modèles peuvent décrire globalement ce qu’ils voient, mais ne doivent servir à établir aucun diagnostic. Consultez toujours un professionnel de santé.

Toute information susceptible d’évoluer dans une photo. Graphique boursier de la veille, capture d’un match en direct ou météo actuelle : le modèle peut lire le contenu de l’image, mais ne sait pas s’il est encore d’actualité.

La vérification de confidentialité de trente secondes

C’est ici que le téléversement d’images diffère de la saisie de texte. Des personnes qui ne colleraient jamais de données client dans ChatGPT téléversent volontiers une capture des mêmes informations, car appuyer sur le bouton de l’appareil photo paraît anodin. Avant tout téléversement, passez en revue cinq questions :

  1. Cette image contient-elle des informations personnelles concernant quelqu’un ? Noms, visages — notamment ceux d’enfants —, adresses personnelles, numéros d’identification, plaques d’immatriculation, numéros de compte bancaire, pages de passeport ou données médicales. Si oui, recadrez ou masquez ces informations avant le téléversement, ou renoncez à l’envoyer.
  2. Cette image contient-elle quelque chose couvert par la politique de données de votre employeur ? Données client, documents internes marqués confidentiels, code source de vos dépôts d’entreprise, informations de salaire, tout sous NDA. Si oui, utilisez l’IA approuvée par votre entreprise (Microsoft Copilot avec entreprise, ChatGPT Enterprise, etc.) — pas votre compte personnel.
  3. L’option « Améliorer le modèle pour tout le monde » est-elle activée ? Dans ChatGPT, elle se trouve sous Paramètres → Contrôles des données. Désactivez-la par défaut avant de téléverser un contenu que vous ne souhaiteriez pas voir affiché publiquement. Les autres outils proposent des réglages similaires.
  4. Cette image pourrait-elle être copiée et divulguée depuis les journaux de l’IA ? C’est probablement peu vraisemblable — les principaux fournisseurs disposent de mesures de sécurité correctes —, mais vous ne pouvez pas l’exclure. Traitez tout téléversement sensible comme un envoi par e-mail : supposez que son contenu puisse subsister indéfiniment.
  5. Y a-t-il une manière plus simple d’extraire juste la partie dont vous avez besoin ? Souvent, la réponse est oui. Une photo d’une seule ligne d’un contrat est bien meilleure qu’une photo de toute la page.

Règle pratique : si vous ne colleriez pas le contenu de l’image en tant que texte dans la discussion, ne téléchargez pas non plus l’image.

Essayez cette semaine

Trois utilisations simples pour rendre le téléchargement d’images réflexif :

  1. Photographiez un graphique d’un document que vous lisez cette semaine et demandez au modèle ce qu’il implique.
  2. Prenez une photo d’un reçu et demandez une extraction structurée des dépenses.
  3. Prenez une capture d’écran d’une diapositive sur laquelle vous avez des doutes et demandez au modèle une analyse de sa structure.

Après ces trois essais, vous commencerez à repérer partout des occasions de téléverser des images. Gardez simplement à l’esprit la vérification de confidentialité : elle prend trente secondes et évite toute une catégorie de problèmes que vous ne souhaitez vraiment pas rencontrer.

À lire ensuite

Continuez sur le même parcours d'apprentissage avec les prochains articles pratiques.