Af Oluwole Akinwale, Direktør for Professional Services
Du bruger måske en AI-assistent til at udarbejde e-mails, sammenfatte tekster eller hjælpe med online-shopping. Du stoler vel på, at den gør præcis, hvad du beder den om, ikke?
Men hvad nu hvis nogen formåede at snige hemmelige instruktioner ind, uden at du vidste det?
Prompt injection er en lumsk måde at narre AI på ved at skjule kommandoer i det indhold, den læser. Når man diskuterer cybersikkerhed, refererer “injection” til at indsætte noget i en eksisterende strøm. Så prompt injection tager din prompt, eller den input du giver til en AI, og indsætter skjulte instruktioner i AI'ens input. Tænk på det som om nogen hvisker falske instruktioner til din assistent, før du taler, og assistenten følger dem i stedet for at lytte til dig.
Sådan virker Prompt Injection
Prompt injection udnytter, hvordan AI læser tekst. AI-modeller har ofte svært ved at skelne mellem, hvad brugeren bad om, hvad udvikleren havde til hensigt, og hvad en dårlig aktør stille og roligt indsatte.
Hvis AI'en ser skadelige instruktioner, der ligner normal tekst, kan den følge dem. Forestil dig, at du bruger en AI til at administrere din kalender og modtager en invitation via e-mail. E-mailen ser ud til at være fra en kollega, men den indeholder skjulte instruktioner til AI'en om at tilføje et møde med forkerte detaljer, hvilket forstyrrer din tidsplan. Der er to primære måder, dette sker på:
- Direkte indsprøjtning En bruger indtaster instruktioner, der direkte manipulerer AI'en.
- Indirekte indsprøjtning: Nogen skjuler kommandoer i noget, som AI'en læser, såsom en e-mail, webside eller dokument.
Denne slags ting sker allerede i virkeligheden:
Gmails AI-resuméer narres af skjulte kommandoer
Googles AI kan opsummere lange e-mails for dig. I 2025 fandt forskere ud af, at angribere kunne skjule usynlig tekst i en e-mail, for eksempel ved at bruge en hvid skrifttype på en hvid baggrund, med hemmelige instruktioner. AI'en fulgte disse skjulte instruktioner og gav vildledende resuméer, selv når e-mailen var risikabel eller bedragerisk.
Chatbot blev narret til at tilbyde en bil til $76.000 for $1
I december 2023 besøgte Chris Bakke en Chevrolet-forhandlers hjemmeside og gjorde noget, der både var sjovt og lidt bekymrende. Med blot et par smarte message'er fik han deres ChatGPT-drevne chatbot til at gå med til at sælge ham en $76.000 Chevy Tahoe for $1.
Hvorfor det er vigtigt
Prompt-injektion trænger ikke ind i dit system som malware. I stedet overtager den samtalen mellem dig og AI’en. Da AI behandler tekst som instruktioner, kan en skadelig prompt omgå udviklerens beskyttelsesforanstaltninger, hvis modellen ikke kan skelne mellem sikre message’er og en angribers indtastninger.
Det betyder, at selv hverdagsredskaber kan tvinges til at opføre sig mærkeligt, hvis nogen kender de rigtige tricks.
Hvad du kan gøre som bruger
Mens udviklere konstant arbejder på at opbygge bedre forsvar, kan du beskytte dig selv i mellemtiden ved at:
1. At være forsigtig med AI-input.
Undgå at indsætte upålidelig tekst eller dokumenter.
2. Holde øje med underlig opførsel.
Hvis AI'en begynder at opføre sig mærkeligt, skal du ikke ignorere det. Du kan også rapportere anomalien gennem de relevante kanaler, hvilket hjælper med at redde tusindvis eller endda millioner af andre brugere.
3. Vælg troværdige værktøjer.
Brug AI-tjenester og plugins fra velkendte udbydere, der opdateres hyppigt og prioriterer sikkerhed. For at sikre, at et værktøj er pålideligt, skal du kigge efter nylige opdateringer eller tjekke, om udbyderen hyppigt udsender rettelser. Vær også opmærksom på sikkerhedsmærker eller certificeringer, der indikerer grundig testning for privatliv og databeskyttelse.
Disse trin giver dig mulighed for at træffe sikrere valg og bevare kontrollen over dine AI-interaktioner.
Bundlinje
Prompt injection minder om social engineering, som involverer at narre folk til at give vigtige oplysninger fra sig. Men for AI behøver den ikke et kodeord; den behøver bare de rette ord på det rette sted.
Heldigvis, jo mere vi forstår det, jo lettere er det at bemærke, når noget ikke er rigtigt. Bevidsthed er dit første forsvar og hjælper med at sikre, at din digitale assistent arbejder for dig, ikke for en anden.
InfografikHvorfor automatisering har brug for ansvarlighed
Blog—Det usynlige lag: Styring af AI inde i iPaaS-platforme