AI-agents veilig inzetten
Agents die zelfstandig handelen zijn krachtig én risicovol. De incidenten die het nieuws halen, ontstaan zelden door kwade opzet — meestal doet de agent net iets te ijverig zijn werk.
Het kernprobleem
Een agent optimaliseert voor het doel dat je hem geeft. Grenzen die je niet expliciet benoemt, bestaan voor hem niet. Vraag je om "zorg dat deze afspraak doorgaat", dan kan hij routes kiezen die jij nooit bedoeld had.
Maatregelen die werken
- Minimale rechten: geef toegang tot precies wat nodig is, niet meer.
- Bevestiging bij onomkeerbare acties: versturen, verwijderen, betalen — daar hoort een mens tussen.
- Logboeken: leg elke actie vast, zodat je achteraf kunt reconstrueren.
- Grenzen in de omgeving: laat de agent draaien in een afgeschermde ruimte met beperkte toegang.
- Uitgavenlimiet: begrens hoeveel stappen of kosten een taak mag opleveren.
Begin klein
Laat een agent eerst voorstellen doen die een mens goedkeurt. Werkt dat betrouwbaar, geef dan geleidelijk meer zelfstandigheid. Andersom beginnen levert de verhalen op die je liever niet over je bedrijf leest.