Når din AI blir lurt: AI-prompt-fella

Din betrodde KI-assistent følger kanskje noen andre sine skjulte kommandoer. Oppdag hvordan den usynlige trusselen fra ledetekstinjeksjon (prompt injection) fungerer, og hvilke enkle skritt du kan ta for å beskytte ditt digitale arbeidsrom.
Når din AI blir lurt: AI-prompt-fella

Av Oluwole Akinwale, Direktør for Professional Services

Du bruker kanskje en AI-assistent til å skrive utkast til e-poster, oppsummere messages eller få hjelp med netthandel. Du stoler vel på at den gjør akkurat det du har bedt om, ikke sant?

Men hva om noen klarte å snike inn hemmelige instruksjoner uten at du visste det?

Prompt-injeksjon er en utspekulert måte å lure KI på ved å gjemme kommandoer i innholdet den leser. Når man snakker om cybersikkerhet, refererer “injeksjon” til å sette inn noe i en eksisterende flyt. Prompt-injeksjon tar derfor ledeteksten din, eller inputen du gir til en KI, og setter inn skjulte instruksjoner i KIs input. Tenk på det som om noen visker falske instruksjoner til assistenten din før du snakker, og assistenten følger dem i stedet for å høre på deg.

Slik fungerer prompt-injeksjon

Prompt-injeksjon utnytter hvordan KI leser tekst. KI-modeller har ofte problemer med å skille mellom hva brukeren ba om, hva utvikleren mente, og hva en ondsinnet aktør i stillhet har satt inn.

Hvis AI-en ser skadelige instruksjoner som ser ut som vanlig tekst, kan den komme til å følge dem. Tenk deg at du bruker en AI til å administrere kalenderen din og mottar en invitasjon via e-post. E-posten ser ut til å være fra en kollega, men den inneholder skjulte instruksjoner til AI-en om å legge til et møte med feil detaljer, noe som forstyrrer timeplanen din. Det er to hovedmåter dette skjer på:

  1. Direkte innsprøytning En bruker skriver instruksjoner som direkte manipulerer AI-en.
  2. Indirekte innsprøytning Noen skjuler kommandoer i noe AI-en leser, for eksempel en e-post, en nettside eller et dokument.

Denne typen ting skjer allerede i det virkelige liv:

Gmails KI-sammendrag lurt av skjulte kommandoer

Gmails kunstige intelligens kan oppsummere lange e-poster for deg. I 2025 fant forskere ut at angripere kunne skjule usynlig tekst i en e-post, for eksempel ved å bruke hvit skrift på hvit bakgrunn, med hemmelige instruksjoner. Den kunstige intelligensen fulgte disse skjulte instruksjonene og ga misvisende sammendrag, selv når e-posten var risikabel eller bedragersk.

Chatbot ble lurt til å tilby en bil til $76 000 for $1

I desember 2023 besøkte Chris Bakke nettsiden til en Chevrolet-forhandler og gjorde noe som både var morsomt og litt bekymringsfullt. Med bare noen få smarte message-er fikk han deres ChatGPT-drevne chatbot til å gå med på å selge ham en $76 000 Chevy Tahoe for $1.

Hvorfor det betyr noe

Prompt-injeksjon trenger seg ikke inn i systemet ditt på samme måte som skadelig programvare. I stedet tar den kontroll over samtalen mellom deg og AI-en. Siden AI behandler tekst som instruksjoner, kan en skadelig prompt omgå utviklerens sikkerhetstiltak dersom modellen ikke klarer å skille mellom ufarlige messages og innspill fra en angriper.

Dette betyr at selv helt vanlige verktøy kan bli tvunget til å oppføre seg på merkelige måter hvis noen kan de rette triksene.

Hva du kan gjøre som bruker

Mens utviklere kontinuerlig arbeider for å bygge bedre forsvar, kan du i mellomtiden beskytte deg selv ved å:

1. Vær forsiktig med hva du oppgir til KI.

Unngå å lime inn utillitstriket tekst eller dokumenter.

2. Ser etter uvanlig oppførsel.

Hvis kunstig intelligens begynner a oppfore seg rart, ma du ikke ignorere det. Du kan ogsa rapportere avviket gjennom egnede kanaler, noe som bidrar til a redde tusenvis eller til og med millioner av andre brukere.

3. Velg pålitelige verktøy.

Bruk AI-tjenester og programtillegg fra velkjente leverandører som oppdaterer seg ofte og prioriterer sikkerhet. For å sikre at et verktøy er pålitelig, bør du se etter nylige oppdateringer eller sjekke om leverandøren hyppig gir ut sikkerhetsrettelser. Vær også på utkikk etter sikkerhetsmerker eller sertifiseringer som indikerer grundig testing for personvern og databeskyttelse.

Disse trinnene gir deg mulighet til å ta sikrere valg og beholde kontrollen over dine AI-interaksjoner.

Konklusjon

Prompt-injeksjon ligner på sosial manipulering, som innebærer å lure folk til å gi fra seg viktig informasjon. Men for kunstig intelligens trenger den ikke et passord; den trenger bare de rette ordene på rett sted.

Heldigvis, jo mer vi forstår det, desto enklere er det å merke når noe ikke stemmer. Å være bevisst er din første forsvarslinje og bidrar til å sikre at din digitale assistent fungerer for deg, ikke for noen andre.

Har du spørsmål? Vi er her for å hjelpe.

Kontakt oss