SundAIBe om ett förslag
Meny

SundAI / Insights

AI-SÄKERHET

Ett dokument kan styra om er AI. Vad stoppar det?

Förstå prompt injection och kontrollerna som behövs utanför prompten.

Av SundAI3 min läsning

Det korta svaret

Prompt injection uppstår när innehåll som ett AI-system möter styr det bort från den avsedda uppgiften. Instruktionen kan komma från ett dokument eller en webbsida. Skydda applikationen runt modellen så ett manipulerat svar inte automatiskt blir en godkänd åtgärd.

Åtkomsten runt modellen avgör den praktiska risken

OWASP och NCSC beskriver hur opålitligt innehåll kan påverka modellen. En instruktion att ignorera skadlig text är inte en fullständig säkerhetsgräns. Konsekvensen beror på vilka uppgifter och åtgärder systemet gör tillgängliga.

OWASP — Prompt Injection (2025) · NCSC — Prompt injection is not SQL injection

Frågor innan ni godkänner en AI-assistent

Detta är vårt förslag till arbetsblad för inköp. Be om demonstrationer i en behörig testmiljö med konstruerade eller uttryckligen godkända testuppgifter.

FrågaEn användbar demonstration
Kan hämtat innehåll ändra uppgiften?Ett ofarligt testdokument ber assistenten avvika från uppgiften. Undersök svaret och försöken till åtgärder.
Kan den se en annan användares uppgifter?Två testkonton med olika rättigheter ställer närliggande frågor. Kontrollera källornas åtkomstregler.
Kan ett svar utlösa en viktig åtgärd?Assistenten föreslår en ej godkänd ändring. Kontrollera att en oberoende rättighets- eller godkännandekontroll blockerar den.
Kan den skicka information vidare?Granska tillåtna destinationer och prova en kontrollerad begäran mot en ej godkänd testdestination.
Kan ett fel utredas?Återskapa källa, modell- eller konfigurationsversion, verktygsbegäran och applikationens beslut.

Ett tänkt exempel: ett manipulerat supportdokument

En assistent skriver ett kundsvar utifrån en kunskapsbas. Ett testdokument innehåller en ovidkommande instruktion att exportera kunduppgifter. Målet är mer än ett artigt avslag: arbetsflödet bör inte ha en generell exportfunktion. Om modellen ändå producerar en farlig instruktion ska en separat kontroll neka den. Dokumentera både modellens och applikationens beteende. Exemplet är fiktivt och beskriver ingen kundincident.

Definiera framgång före testet

Skriv förväntat resultat: vilka uppgifter får returneras, vilka åtgärder är tillåtna och när ska en människa besluta? Inkludera vanliga frågor så testet också upptäcker kontroller som gör assistenten oanvändbar. Ett avgränsat godkänt test bevisar inte universell motståndskraft. Upprepa relevanta test efter ändringar av modell, prompt, källor eller verktyg.

Använd frågorna i leverantörsdialogen

Klargör leverantörens och ert ansvar. Vilka kontroller är inbyggda och vilka beror på er konfiguration? Behåll öppna frågor i inköpsbeslutet. En övertygande demonstration är inte i sig tillräcklig evidens för hela systemet.

Förstå vägen från AI-svar till verklig åtgärd

Be om en avgränsad säkerhetsbedömning av en assistent, agent eller leverantör. Avtala frågor och evidens innan arbetet börjar.

Be om ett förslag →

Läs vidare

Källor och metod

OWASP — Prompt Injection (2025) · NCSC — Prompt injection is not SQL injection

AI-assisterad redaktionell guide från SundAI. Källor kontrollerade 18 september 2026. Hög tillförlitlighet för dokumenterade riskmekanismer; arbetsblad och exempel är förslag till praktik, inte uppmätta kundresultat eller en säkerhetsgaranti. Framtidsscenarier är inte prognoser.