Lov og trygghet
Hva er Prompt injection?
Også kalt: promptinjeksjon, instruksjonsangrep
Prompt injection er et angrep der noen gjemmer instruksjoner i innhold en KI leser – en e-post, et dokument, en nettside – for å få KI-en til å gjøre noe annet enn eieren har bedt om.
Der klassisk hacking angriper koden, angriper prompt injection språket: en «kunde» sender en e-post med skjult tekst som ber KI-agenten utlevere data eller sende penger, og agenten som leser e-posten kan oppfatte det som en instruks fra sjefen.
Problemet er reelt nok til at det regnes som den viktigste sikkerhetsrisikoen for KI-agenter, og det er en hovedgrunn til at agenter aldri bør få ubegrensede fullmakter: alt en agent leser, kan i teorien forsøke å styre den.
Hva betyr det for bedriften din?
Spørsmålet til enhver leverandør av KI-agenter: «hva skjer hvis noen sender agenten en ondsinnet instruks i en e-post?» Gode svar handler om begrensede fullmakter, menneskelig godkjenning av alt som koster penger, og logging. Dårlige svar handler om at det nok går bra.
Ofte stilte spørsmål om Prompt injection
Er prompt injection farlig for oss som bare bruker ChatGPT?
Lite – når et menneske leser svaret før noe skjer, er skadepotensialet begrenset. Risikoen oppstår når KI-agenter handler selvstendig på innhold utenfra: e-post, skjemaer, dokumenter og nettsider.
Hvordan beskytter man seg mot prompt injection?
Begrens hva agenten kan gjøre (minst mulig fullmakter), krev menneskelig godkjenning for utbetalinger og datautlevering, skill instrukser fra innhold der det er mulig, og logg alt agenten gjør. Ingen enkeltteknikk fjerner risikoen helt – lagene sammen gjør den håndterbar.
Relaterte begreper
Guider som forklarer mer
Sist oppdatert: 16. juli 2026 · Om AI Systemet