SundAIBed om et forslag
Menu

SundAI / Insights

AI-SIKKERHED

Et dokument kan omdirigere jeres AI. Hvad stopper det?

Forstå prompt injection og de kontroller, der virker uden for prompten.

Af SundAI3 min. læsning

Det korte svar

Prompt injection opstår, når indhold, som et AI-system møder, styrer det væk fra den tilsigtede opgave. Instruktionen kan komme fra et dokument eller en hjemmeside. Beskyt den omgivende applikation, så et manipuleret svar ikke automatisk bliver en godkendt handling.

Adgangen omkring modellen afgør den praktiske risiko

OWASP og NCSC beskriver, hvordan indhold fra en utroværdig kilde kan påvirke modellen. En instruktion om at ignorere ondsindet tekst er ikke en fuldstændig sikkerhedsgrænse. Konsekvensen afhænger af de oplysninger og handlinger, systemet stiller til rådighed.

OWASP — Prompt Injection (2025) · NCSC — Prompt injection is not SQL injection

Spørgsmål før I godkender en AI-assistent

Dette er vores forslag til et arbejdsark for indkøb. Bed om demonstrationer i et autoriseret testmiljø med konstruerede eller udtrykkeligt godkendte testdata.

SpørgsmålEn nyttig demonstration
Kan hentet indhold ændre opgaven?Et harmløst testdokument beder assistenten afvige fra opgaven. Undersøg svaret og forsøgte handlinger.
Kan den se en anden brugers dokumenter?To testkonti med forskellige rettigheder stiller beslægtede spørgsmål. Kontrollér kildernes adgangsregler.
Kan et svar udløse en væsentlig handling?Assistenten foreslår en ikke-godkendt ændring. Kontrollér, at en uafhængig rettigheds- eller godkendelseskontrol blokerer den.
Kan den sende oplysninger videre?Gennemgå tilladte destinationer, og test en kontrolleret forespørgsel mod en ikke-godkendt testdestination.
Kan en fejl undersøges?Rekonstruér kilde, model- eller konfigurationsversion, værktøjsanmodning og applikationens beslutning.

Et tænkt eksempel: et manipuleret supportdokument

En assistent laver et kundesvar fra en vidensbase. Et testdokument indeholder en uvedkommende instruks om at eksportere kundedata. Målet er mere end en høflig afvisning: arbejdsgangen bør slet ikke have en generel eksportfunktion. Hvis modellen alligevel producerer en farlig instruktion, skal en separat kontrol afvise den. Registrér både modellens og applikationens adfærd. Eksemplet er fiktivt og beskriver ikke en kundehændelse.

Definér succes før testen

Skriv det forventede resultat: hvilke data må returneres, hvilke handlinger er tilladt, og hvornår skal et menneske beslutte? Inkludér almindelige forespørgsler, så testen også opdager kontroller, der gør assistenten ubrugelig. Et afgrænset bestået forsøg beviser ikke universel modstandsdygtighed. Gentag relevante test efter ændringer af model, prompt, kilder eller værktøjer.

Brug spørgsmålene over for leverandøren

Afklar leverandørens og jeres ansvar. Hvilke kontroller er indbygget, og hvilke afhænger af jeres opsætning? Behold åbne spørgsmål i indkøbsbeslutningen. En overbevisende demonstration er ikke i sig selv tilstrækkelig evidens for hele systemet.

Forstå vejen fra AI-svar til faktisk handling

Bed om en afgrænset sikkerhedsvurdering af en assistent, agent eller leverandør. Aftal spørgsmål og evidens før arbejdet.

Bed om et forslag →

Læs videre

Kilder og metode

OWASP — Prompt Injection (2025) · NCSC — Prompt injection is not SQL injection

AI-assisteret redaktionel guide fra SundAI. Kilder kontrolleret 18. september 2026. Høj sikkerhed om de dokumenterede risikomekanismer; arbejdsark og eksempler er forslag til praksis, ikke målte kunderesultater eller en sikkerhedsgaranti. Fremtidsscenarier er ikke forudsigelser.