13:22LiveOverflow
Elle présente l'injection de prompt comme une attaque classique contre un système qui mélange instructions et données non fiables. Un exemple concret montre comment, dans un dispositif de modération de contenu, un attaquant peut faire accuser un utilisateur innocent. Passer de « le modèle est la cible » à « l'application est la cible » constitue précisément le changement de perspective qui ouvre l'article.
Ce que vous en retirerez: Modéliser l'injection de prompt comme un mélange de données non fiables et définir des limites de conception autour de l'utilisation des outils.
À voir ou à connaître au préalable: Une intuition générale en sécurité web est utile ; aucune connaissance préalable en sécurité des LLM n'est supposée.
Note d’AI Expert: Considérez cette vidéo comme un guide conceptuel. N'utilisez aucune donnée réelle de l'entreprise tant que les règles d'autorisation, de conservation, de journalisation et de validation humaine ne sont pas clairement définies.
