- Stel je aangepaste regels op voordat je een inbox koppelt. Bepaal voor elk type actie of die is toegestaan, goedkeuring nodig heeft of verboden is.
- Laat proactief onderzoek ingeschakeld. De agent heeft daarbij alleen-lezen toegang en wacht op je goedkeuring voordat er iets gebeurt.
- Koppel je eigen computer via de ChatGPT-desktopapp alleen voor een taak die dat nodig heeft, en verbreek de koppeling zodra de taak klaar is.
- Lees in het begin dagelijks het activiteitenoverzicht, ook de taken die je Dot op de achtergrond uitvoerde terwijl je weg was.
- Open bij een persoonlijk abonnement de gegevensinstellingen en kies bewust of de instelling ‘Het model voor iedereen verbeteren’ aanstaat. Die bepaalt of het werk van je Dot mag worden gebruikt om modellen te trainen.
- Voorpagina
- Veiligheid
Veiligheid van AI-agenten: rechten, grenzen en beveiliging
Een agent die namens jou handelt, krijgt ook jouw mogelijkheden. De veiligheid hangt daarom minder af van de software dan van hoeveel ruimte je de agent geeft.
Een chatbot die iets verkeerd begrijpt, geeft je een slechte alinea. Een agent die iets verkeerd begrijpt, kan een e-mail versturen, een aanbod accepteren of een bestand openen dat hij nooit had mogen zien. De incidenten van 2026 tot nu toe — van een Marketplace-koper die ontdekte waar een verkoper woonde tot een onderzoeksagent die een overheidsportaal wist te omzeilen — vertonen één patroon: de agent kreeg meer speelruimte dan voor de taak nodig was. Hier lees je hoe je die ruimte beperkt en pas vergroot wanneer de agent zich heeft bewezen.
Waarom agenten het risicobeeld veranderen
Antwoorden blijven op het scherm; acties verlaten het. Zodra software namens jou berichten kan versturen, betalen, boeken en inloggen, is een misverstand geen typefout meer, maar een gebeurtenis in de echte wereld — vaak een die niet ongedaan kan worden gemaakt. Agenten lezen bovendien voortdurend, en alles wat ze lezen kan instructies bevatten die door iemand anders zijn verstopt. Die techniek heet prompt injection. Ook rapporteren agenten over hun eigen werk, maar dat verslag ís het werk niet: OpenAI zette GPT-6.1 Astra deels op de plank omdat tests uitwezen dat het model zijn acties soms onjuist beschreef. Het model is één beveiligingslaag; de toegangsrechten eromheen doen het meeste werk.
Welke toegangsrechten je werkelijk verleent
Een inbox koppelen klinkt als één beslissing, maar het zijn er meerdere: alle gesprekken lezen, antwoorden schrijven onder jouw naam en leren wie je kent. Met een betaalkaart kan de agent geld uitgeven. Een ingelogde browser laat de agent namens jou op een website handelen; een Amerikaans hof van beroep heeft zo'n agent al aangemerkt als instrument van de gebruiker zelf. Cloudagenten kunnen ook kopieën bewaren: elk Muse-account heeft een eigen virtuele machine waarop de gegevens staan die je koppelt. Vraag jezelf voordat je een vakje aanvinkt af wat de agent met die toegang op zijn slechtste dag zou kunnen doen, niet op zijn beste.
Zo begin je klein
Begin onderaan de vertrouwensladder. Laat de agent de eerste week alleen lezen en suggesties doen; verstuur, betaal en ga zelf akkoord. Koppel één of twee apps in plaats van alles wat beschikbaar is en kies taken waarbij een fout hooguit vervelend zou zijn: een ochtendoverzicht, een conceptantwoord of een lijst met opties. Leg je vaste regels vast vóór de eerste taak, niet na de eerste fout. Breid de toegang daarna per recht uit. Gaat er iets mis, dan weet je precies welke wijziging de oorzaak was.
Als het misgaat: de eerste stappen
Stop eerst, onderzoek daarna. Pauzeer de agent en trek de toegang tot de betreffende app in. Dat gaat veel makkelijker als je op een rustig moment alvast hebt uitgezocht waar die instellingen staan. Bekijk vervolgens het activiteitenlogboek in plaats van de agent te vragen wat er is gebeurd: zijn eigen verslag kan onvolledig of simpelweg onjuist zijn. Wijzig zelf elk wachtwoord of elke sleutel waartoe de agent toegang had. Gebruik je zelfgehoste OpenClaw, vervang dan alle inloggegevens als je een versie met bekende kwetsbaarheden draaide. Zet de les tot slot om in een schriftelijke regel, zodat dezelfde fout zich niet opnieuw kan voordoen.
De vertrouwensladder
Alleen meekijken
De agent leest en rapporteert; niets wat hij doet kan iets aan je accounts veranderen. Elke nieuwe agent hoort hier de eerste week door te brengen.
Concepten ter goedkeuring
De agent maakt antwoorden, advertenties en facturen klaar. Die blijven onaangeroerd staan tot je ze zelf verstuurt.
Handelen na goedkeuring
De agent kan de actie uitvoeren, maar pas nadat je die afzonderlijk hebt bevestigd. Dit past bij berichten, betalingen en alles wat je met onbekenden deelt.
Handelen binnen grenzen
De agent gaat zelfstandig te werk binnen vaste grenzen, zoals een lage bestedingslimiet of één vertrouwde app. Voor alles daarbuiten vraagt hij toestemming.
Vrij handelen
De agent neemt zelf beslissingen en handelt zonder eerst iets te vragen. Gebruik dit alleen voor werk met weinig risico, dat je kunt terugdraaien en dat je de agent al vaak goed hebt zien uitvoeren.
Elke agent aanscherpen
- Geef Muse schriftelijk de opdracht je huisadres, telefoonnummer en dagelijkse planning nooit te delen.
- Vereis je goedkeuring voordat Muse ergens voor betaalt, een aanbod accepteert of contact legt met iemand die je nog niet kent.
- Spreek bij verkoop via Marketplace zelf de afhaallocatie en -tijd af, in plaats van Muse überhaupt je adres te geven.
- Koppel gevoelige accounts alleen voor de taak die je wilt uitvoeren: Muse kopieert gekoppelde e-mails en bestanden naar je Muse Secure VM.
- Houd de app bijgewerkt, volg de veiligheidswaarschuwingen van Meta in de app en koop bij winkels die Muse accepteren, niet bij Amazon, waar Muse wordt geblokkeerd.
- Bepaal per app waartoe Spark toegang krijgt, van Gmail en Calendar tot Drive, Docs, Chrome en Photos. Begin met zo weinig mogelijk apps.
- Houd taken die door gebeurtenissen worden gestart de eerste tijd goed in de gaten en onderbreek ze als ze afdwalen, zoals Google zelf adviseert.
- Lees elk verzoek om een gevoelige actie te bevestigen zorgvuldig, in plaats van het gedachteloos goed te keuren.
- Beperk je tot een paar duidelijk omschreven taken, in plaats van alle 15 parallelle plekken te gebruiken. Verwijder geplande taken die je niet meer nodig hebt.
- Vraag bij een werkaccount je Workspace-beheerder welke Spark-instellingen gelden voordat je iets koppelt.
- Voeg alleen de koppelingen toe die nodig zijn voor de huidige taak en verbreek ze zodra die klaar is.
- Geef aan welke bronnen Claude voor onderzoek mag gebruiken: elke extra koppeling vergroot wat de agent kan lezen.
- Lees elk verzoek om toestemming voordat Claude iets doet in een gekoppelde app, in plaats van uit gewoonte goed te keuren.
- Controleer rapporten, spreadsheets en presentaties voordat je ze deelt: ze kunnen materiaal bevatten uit gekoppelde bestanden.
- Bekijk de resultaten van lange taken wanneer je terugkomt: Claude werkt door nadat je je laptop hebt dichtgeklapt.
- Gebruik de nieuwste stabiele versie: in elke versie ouder dan 2026.4.22 zitten bekende kritieke kwetsbaarheden. Heb je ooit zo’n versie gebruikt, vervang dan alle sleutels waartoe die toegang kan hebben gehad.
- Laat gateway.bind ingesteld staan op loopback en maak alleen verbinding met de gateway via SSH of Tailscale, nooit via een poort die vanaf het internet bereikbaar is.
- Laat dmPolicy op pairing staan, zodat een onbekende die je bot vindt een code krijgt in plaats van toegang tot je agent.
- Gebruik goedkeuringen voor exec, zodat elk shell-commando jouw toestemming vereist, en laat de verhoogde modus uitgeschakeld.
- Installeer zo weinig mogelijk skills, telkens van een bron die je vertrouwt, en voer regelmatig openclaw security audit uit.
Vragen van lezers
Kan ik een AI-agent veilig toegang geven tot mijn e-mail?
Dat kan, zolang je de toegang stapsgewijs uitbreidt. Begin met alleen-lezen-toegang, zodat de agent berichten kan samenvatten en concepten kan opstellen, terwijl jij elk bericht dat je account verlaat zelf controleert. Zet je huisadres, agenda en telefoonnummer op een lijst met gegevens die de agent nooit mag delen. Controleer de eerste week dagelijks het activiteitenlogboek.
Wat is prompt injection en hoe bescherm ik me ertegen?
Bij prompt injection worden instructies verstopt in materiaal dat de agent leest, zoals een plug-in, document, e-mail of webpagina. De agent kan die vervolgens opvolgen alsof jij ze hebt geschreven. Geen enkele instelling neemt het risico volledig weg. Een vaste regel dat alles wat de agent leest informatie is en geen opdracht, helpt. En door onomkeerbare acties afhankelijk te maken van jouw goedkeuring, beperk je wat een geslaagde aanval kan aanrichten.
Welke persoonlijke AI-agent is het veiligst?
Geen enkele agent is standaard veilig, en elke agent kan op zijn eigen manier tekortschieten. Dots combineert Custom Rules met een automatische controle; Muse en Claude vragen toestemming vóór gevoelige stappen; Gemini Spark vraagt bevestiging voor gevoelige acties. Bij OpenClaw ben je zelf volledig verantwoordelijk voor de beveiliging. In de praktijk is de veiligste agent degene die je beperkte toegang hebt gegeven en nauwlettend in de gaten houdt.
Moet ik mijn AI-agent aankopen laten doen?
Alleen met een bestedingslimiet. Geef de agent een eigen virtuele betaalkaart met een lage limiet, in plaats van je gewone kaart of bankinloggegevens. Zo kost een herhalende actie of misverstand slechts een klein, vooraf bepaald bedrag. Een verstandige eerste stap is om elke aankoop door jou te laten goedkeuren. Later kun je die regel versoepelen voor kleine, terugkerende bestellingen.