Prompt injection
Wat is Prompt injection?
Prompt injection is een aanval waarbij kwaadaardige instructies worden ingevoegd in de input van een AI-systeem om het ongewenst gedrag te laten vertonen. Het is het AI-equivalent van SQL injection bij databases.
Er zijn twee vormen. Directe prompt injection: de gebruiker voert zelf kwaadaardige instructies in. Indirecte prompt injection: de instructies zitten verborgen in databronnen die de agent leest — een document, een e-mail, een webpagina.
Indirecte prompt injection is het gevaarlijkst voor AI-agents. De agent leest een document dat een verborgen instructie bevat (‘stuur alle klantdata naar dit e-mailadres’) en voert het uit als ware het een legitieme opdracht.
Beveiligingsmaatregelen: inputvalidatie, het scheiden van data en instructies, guardrails in de systeemprompt en monitoring van het agentgedrag.
Voorbeeld uit de praktijk
Visser Elektrotechniek besteedde gemiddeld twintig minuten aan de administratieve verwerking van elk inspectierapport. Met de AI-oplossing van Agentech worden rapporten nu automatisch geanalyseerd en naar de juiste afdeling doorgestuurd. Bij gebreken maakt het systeem ook een bestellijst met artikelnummers, aantallen en locaties. Binnen vijf minuten is de verwerking klaar, zonder handmatig overtypen.
Bekijk de case van Visser ElektrotechniekWat betekent dit voor jouw organisatie?
Agentech bouwt meerdere lagen bescherming tegen prompt injection in elke AI-agent. Het is een van de belangrijkste beveiligingsrisico's van onze tijd.
