Door Oluwole Akinwale, Directeur van Professional Services
Misschien gebruik je wel een AI-assistent om e-mails op te stellen, berichten samen te vatten of je te helpen bij het online winkelen. Je vertrouwt er waarschijnlijk op dat hij precies doet wat je hem vraagt, toch?
Maar wat als iemand erin slaagt om geheime instructies naar binnen te smokkelen zonder dat jij het weet?
Prompt-injectie is een slinkse manier om kunstmatige intelligentie te misleiden door commando's te verbergen in de inhoud die het leest. Bij cybersecurity verwijst “injectie” naar het invoegen van iets in een bestaande stroom. Prompt-injectie neemt dus je prompt, of de invoer die je aan een AI geeft, en voegt verborgen instructies toe aan de invoer van de AI. Zie het als iemand die valse instructies in de oren van je assistent fluistert voordat jij tegen hem praat, en de assistent volgt die op in plaats van naar jou te luisteren.
Hoe Prompt Injection Werkt
Prompt-injectie maakt misbruik van de manier waarop AI tekst leest. AI-modellen hebben vaak moeite om onderscheid te maken tussen wat de gebruiker heeft gevraagd, wat de ontwikkelaar heeft aangeduid en wat een kwaadwillende stiekem heeft ingevoegd.
Als de AI schadelijke instructies ziet die eruitzien als normale tekst, kan hij deze opvolgen. Stel je voor dat je een AI gebruikt om je agenda te beheren en een uitnodiging via e-mail ontvangt. De e-mail lijktbau van een collega te komen, maar bevat verborgen instructies voor de AI om een vergadering toe te voegen met onjuiste details, waardoor je schema in de war raakt. Er zijn twee manieren waarop dit voornamelijk gebeurt:
- Directe injectie Een gebruiker typt instructies die de AI direct manipuleren.
- Indirecte injectie: Iemand verbergt commando's in iets dat de AI leest, zoals een e-mail, webpagina of document.
Dit soort dingen gebeurt al in het echte leven:
AI-samenvattingen van Gmail misleid door verborgen commando's
De AI van Gmail kan lange e-mails voor je samenvatten. In 2025 ontdekten onderzoekers dat aanvallers onzichtbare tekst in een e-mail konden verbergen, bijvoorbeeld door een wit lettertype op een witte achtergrond te gebruiken, met geheime instructies. De AI volgde die verborgen instructies en gaf misleidende samenvattingen, zelfs wanneer de e-mail riskant of bedrieglijk was.
Chatbot werd misleid om een auto van $76.000 aan te bieden voor $1
In december 2023 bezocht Chris Bakke de website van een Chevrolet-dealer en deed daar iets dat zowel grappig als een beetje verontrustend was. Met slechts een paar slimme message's kreeg hij hun door ChatGPT aangestuurde chatbot zover dat die ermee instemde om hem een $76.000 Chevy Tahoe te verkopen voor $1.
Waarom het ertoe doet
Prompt-injectie dringt niet als malware je systeem binnen. In plaats daarvan neemt het de communicatie tussen jou en de AI over. Aangezien AI tekst als instructies beschouwt, kan een schadelijke prompt de beveiligingsmaatregelen van de ontwikkelaar omzeilen als het model geen onderscheid kan maken tussen veilige messages en de invoer van een aanvaller.
Dit betekent dat zelfs alledaagse hulpmiddelen ertoe kunnen worden gebracht zich op vreemde manieren te gedragen als iemand de juiste trucs kent.
Wat u als gebruiker kunt doen
Terwijl ontwikkelaars voortdurend werken aan het bouwen van betere verdedigingsmechanismen, kun je jezelf in de tussentijd beschermen door:
1. Voorzichtig zijn met AI-invoer.
Vermijd het plakken van niet-vertrouwde tekst of documenten.
2. Let op afwijkend gedrag.
Als de AI zich vreemd begint te gedragen, negeer dit dan niet. Je kunt de anomalie ook melden via de juiste kanalen, waarmee je duizenden of zelfs miljoenen andere gebruikers helpt te beschermen.
3. Kies betrouwbare hulpmiddelen.
Gebruik AI-diensten en -plugins van bekende providers die regelmatig worden geüpdatet en prioriteit geven aan beveiliging. Om te controleren of een tool betrouwbaar is, kun je letten op recente updates of nagaan of de provider regelmatig patches uitbrengt. Let bovendien op beveiligingsbadges of certificeringen die wijzen op strenge tests voor privacy en gegevensbescherming.
Met deze stappen kunt u veiligere keuzes maken en de controle over uw AI-interacties behouden.
De onderstreep
Prompt-injectie lijkt op social engineering, waarbij mensen worden overgehaald om belangrijke informatie prijs te geven. Maar voor AI is er geen wachtwoord nodig; het heeft alleen de juiste woorden op de juiste plek nodig.
Gelukkig is het zo dat hoe beter we het begrijpen, hoe makkelijker het is om te merken wanneer er iets niet klopt. Bewust zijn is je eerste verdediging en zorgt ervoor dat je digitale assistent voor jou werkt, en niet voor iemand anders.
InfographicWaarom automatisering verantwoording behoeft
Blog—De Onzichtbare Laag: Het Besturen van AI Binnen iPaaS-Platformen