Prompt injection herkennen voordat je webteksten in AI plakt

Steeds meer mensen plakken webpagina’s, e-mails en documenten in AI-tools om ze samen te vatten. Dat is handig, maar er zit een risico in: tekst kan instructies bevatten die niet voor jou bedoeld zijn, maar wel door de AI als opdracht worden gelezen.

Dat risico heet prompt injection. Het kan direct zijn, bijvoorbeeld wanneer iemand schrijft: ‘negeer alle vorige instructies’. Het kan ook indirect zijn, bijvoorbeeld in verborgen of onopvallende tekst op een webpagina die een AI-agent probeert te sturen.

OpenAI, NCSC en OWASP noemen prompt injection een belangrijk aandachtspunt voor AI-systemen. De kern is simpel: een taalmodel ziet tekst en instructies in dezelfde stroom. Daardoor kan onbetrouwbare input soms invloed krijgen op gedrag dat jij niet bedoelde.

Voor gewone gebruikers betekent dit niet dat je nooit meer tekst mag plakken. Het betekent wel dat je moet controleren wat je invoert, vooral wanneer een AI-tool toegang heeft tot bestanden, e-mail, browseracties of bedrijfsinformatie.

Let op zinnen die vragen om eerdere instructies te negeren, geheimen te tonen, externe links te openen, gegevens door te sturen of een andere rol aan te nemen. Ook teksten met vreemde witruimte, verborgen HTML of overdreven urgente opdrachten verdienen extra aandacht.

Een simpel voorbeeld: je vraagt AI om een webpagina samen te vatten. In die pagina staat ergens de zin dat eerdere opdrachten genegeerd moeten worden en dat het antwoord een bepaalde link moet aanbevelen. Jij ziet die zin misschien niet direct, maar het model verwerkt hem wel als tekst. Daarom is broncontrole belangrijker zodra AI niet alleen leest, maar ook acties kan voorstellen.

Werk met een vaste scheiding: jouw opdracht bovenaan, daarna pas de onbetrouwbare tekst, en sluit af met de regel dat de aangeleverde tekst alleen als bronmateriaal mag dienen. Vraag het model om verdachte instructies te melden in plaats van ze uit te voeren. Dat maakt het risico niet nul, maar het maakt afwijkend gedrag sneller zichtbaar.

Plak geen vertrouwelijke gegevens in onbekende tools wanneer dat niet nodig is. Haal namen, klantnummers en gevoelige passages weg voordat je test. Voor bedrijfsmatig gebruik hoort prompt injection niet alleen een technisch onderwerp te zijn, maar ook een werkafspraak: welke bronnen vertrouwen we, welke acties mag AI nooit zelfstandig uitvoeren en wanneer kijkt een mens mee?

Een nuttige gewoonte is om samenvatten en handelen uit elkaar te trekken. Laat AI eerst alleen verdachte instructies markeren en de inhoud samenvatten. Pas in een tweede stap beslis je zelf of er een vervolgactie komt. Die extra stap kost weinig tijd en voorkomt dat een onbetrouwbare tekst te veel invloed krijgt.

Gebruik onze prompt injection checker voordat je onbekende tekst in een AI-tool gebruikt. Combineer dit met de hallucinatie-risico checker voor feitelijke vragen.

Verder lezen