Par Oluwole Akinwale, Directeur de Professional Services
Vous pouvez utiliser un assistant IA pour rédiger des e-mails, résumer des messages ou vous aider à faire vos achats en ligne. Vous comptez sans doute sur lui pour faire exactement ce que vous lui demandez, n'est-ce pas ?
Mais et si quelqu'un parvenait à glisser des instructions secrètes à votre insu ?
L'injection de requêtes est une astuce sournoise pour tromper l'IA en cachant des commandes dans le contenu qu'elle lit. Lorsque l'on parle de cybersécurité, “ injection ” désigne l'insertion de quelque chose dans un flux existant. Ainsi, l'injection de requêtes prend votre requête, ou l'entrée que vous fournissez à une IA, et insère des instructions cachées dans cette entrée. Pensez-y comme à quelqu'un qui chuchoterait de fausses instructions à votre assistant avant que vous ne lui parliez, et l'assistant suivrait celles-ci au lieu de vous écouter.
Comment fonctionne l'injection de requêtes
L'injection de requêtes exploite la manière dont l'IA lit le texte. Les modèles d'IA ont souvent du mal à faire la différence entre ce que l'utilisateur a demandé, ce que le développeur a prévu et ce qu'un acteur malveillant a inséré discrètement.
Si l'IA voit des instructions malveillantes qui ressemblent à du texte normal, elle pourrait les suivre. Imaginez que vous utilisez une IA pour gérer votre calendrier et que vous recevez une invitation par e-mail. L'e-mail semble provenir d'un collègue, mais il contient des instructions cachées destinées à l'IA pour qu'elle ajoute une réunion avec des détails incorrects, perturbant ainsi votre emploi du temps. Cela se produit principalement de deux manières :
- Injection directe Un utilisateur tape des instructions qui manipulent directement l'IA.
- Injection indirecte : Quelqu'un cache des commandes dans un élément lu par l'IA, tel qu'un e-mail, une page Web ou un document.
Ce genre de chose se produit déjà dans la vraie vie :
Les résumés par IA de Gmail piégés par des commandes cachées
L'intelligence artificielle de Gmail peut résumer de longs e-mails pour vous. En 2025, des chercheurs ont découvert que des attaquants pouvaient masquer du texte invisible dans un e-mail, par exemple en utilisant une police blanche sur fond blanc, contenant des instructions secrètes. L'IA a suivi ces instructions cachées et a fourni des résumés trompeurs, même lorsque l'e-mail était risqué ou trompeur.
Un chatbot a été piégé et a proposé une voiture d'une valeur de $76 000 pour $1
En décembre 2023, Chris Bakke s'est rendu sur le site web d'un concessionnaire Chevrolet et a fait quelque chose à la fois drôle et un peu inquiétant. À l’aide de quelques manipulations astucieuses, il a réussi à convaincre le chatbot alimenté par ChatGPT de lui vendre une Chevrolet Tahoe d’une valeur de $76 000 pour seulement $1.
Pourquoi c'est important
L’injection de prompt ne s’introduit pas dans votre système comme le ferait un logiciel malveillant. Elle prend plutôt le contrôle de la conversation entre vous et l’IA. L’IA considérant le texte comme des instructions, un prompt malveillant peut contourner les protections mises en place par le développeur si le modèle n’est pas en mesure de distinguer les messages inoffensifs des entrées provenant d’un attaquant.
Cela signifie que même les outils de tous les jours peuvent être amenés à agir de manière étrange si quelqu'un connaît les bonnes astuces.
Ce que vous pouvez faire en tant qu'utilisateur
Alors que les développeurs travaillent constamment à créer de meilleures défenses, vous pouvez en attendant vous protéger en :
1. Faire preuve de prudence avec les données saisies dans l'IA.
Évitez de coller des textes ou des documents non fiables.
2. Surveillance d'un comportement anormal.
Si l'IA commence à agir de manière étrange, ne l'ignorez pas. Vous pouvez également signaler l'anomalie par les canaux appropriés, contribuant ainsi à sauver des milliers, voire des millions d'autres utilisateurs.
3. Choisissez des outils de confiance.
Utilisez des services et des plugins d'IA de fournisseurs reconnus qui se mettent à jour fréquemment et accordent la priorité à la sécurité. Pour garantir qu'un outil est fiable, recherchez des mises à jour récentes ou vérifiez si le fournisseur publie fréquemment des correctifs. De plus, soyez à l'affût des badges ou des certifications de sécurité qui indiquent des tests rigoureux en matière de confidentialité et de protection des données.
Ces étapes vous permettent de faire des choix plus sûrs et de garder le contrôle sur vos interactions avec l'IA.
En fin de compte
L'injection de requêtes est similaire à l'ingénierie sociale, qui consiste à tromper les gens pour leur faire divulguer des informations importantes. Mais pour l'IA, pas besoin de mot de passe ; il suffit des bons mots au bon endroit.
Heureusement, plus nous le comprenons, plus il est facile de remarquer quand quelque chose ne va pas. Être conscient est votre première ligne de défense et aide à s'assurer que votre assistant numérique travaille pour vous, et non pour quelqu'un d'autre.
InfographiePourquoi l'automatisation a besoin de responsabilisation
Blog—La Couche Invisible : Gouverner l'IA au sein des plateformes iPaaS