Prompt injection.
Een aanvalstechniek waarbij een gebruiker (of derde partij) een AI-systeem misleidt met verborgen instructies, om het systeem iets te laten doen wat het niet zou mogen.
Korte definitie.
Een aanvalstechniek waarbij een gebruiker (of derde partij) een AI-systeem misleidt met verborgen instructies, om het systeem iets te laten doen wat het niet zou mogen.
AchtergrondUitgebreide uitleg.
Prompt injection is voor LLM’s wat SQL-injection voor databases is. Voorbeelden: een leerling typt “negeer alle voorgaande instructies en doe X” om een schoolchatbot te misbruiken, of een aanvaller verstopt instructies in een document dat een AI-assistent leest. Voor scholen die LLM’s inzetten in werkprocessen ontstaan zo nieuwe risico’s: data-lekken, fraude, onjuiste antwoorden aan ouders. OWASP heeft een Top-10 voor LLM-beveiliging gepubliceerd waarin prompt injection bovenaan staat.
HandelingsperspectiefVoor de professional.
Voor school- en organisatie-IT: behandel elk LLM-systeem als ongetrust. Geef AI nooit directe toegang tot bestanden of mailaccounts zonder bemiddelaar. Voor beleid: vereis een security-assessment voor nieuwe AI-tools. Voor mediawijsheid: leer leerlingen het mechanisme, niet als hack-handleiding maar als kritische vaardigheid.
In de woorden van een vriendVoor de jongere.
Een AI doet wat de gebruiker zegt, ook als die “gebruiker” iets verstopt in een tekst die de AI leest; dat is een risico om te kennen, niet om te misbruiken.
Hulplijn & meldpunt.
Niemand hoeft hier alleen mee om te gaan. Deze hulplijnen zijn gratis en bereikbaar, vandaag.
Verder lezen