AGENTGRENZEN
FIELD NOTE 05 / 15Je AI-agent heeft niet meer autonomie nodig. Hij heeft betere grenzen nodig.
De nuttige vraag is niet hoeveel werk een agent alleen kan doen. Het is welke beslissingen hij mag nemen, welke gevolgen hij mag veroorzaken en wanneer de organisatie de controle moet overnemen.
Autonomie is alleen nuttig wanneer de grens eromheen expliciet is.
DEEL DEZE FIELD NOTE
Geef het nuttige signaal door.
We blijven autonomie meten aan hoe lang de mens verdwijnt.
Agentdemo's draaien vaak om afwezigheid. Kijk hoe het systeem een account onderzoekt, het CRM bijwerkt, een e-mail opstelt en de volgende stap plant zonder iemand iets te vragen. Elke ontbrekende klik wordt als vooruitgang gepresenteerd.
Maar onafhankelijkheid is niet het commerciële resultaat. Een commerciële agent kan een lange reeks acties voltooien en toch de klantrelatie beschadigen, gevoelige context blootleggen of werk creëren dat een ander team moet terugdraaien. De lengte van de reeks zegt weinig over de gepastheid van de bevoegdheid.
De betere maatstaf is beheersbare impact: hoeveel nuttig werk kan de agent doen terwijl het bedrijf betrouwbaar kan begrenzen, volgen en terugdraaien wat er gebeurt?
Het doel is niet een agent die nooit iets vraagt. Het is een agent die weet wanneer hij dat moet doen.
Toegang vertelt de agent wat hij kan doen. Niet wat jij bedoelde.
Een gekoppeld CRM kan een agent toelaten elke verkoopkans te bewerken. Een inboxkoppeling kan technisch toelaten elke contactpersoon te mailen. Die rechten beschrijven de tool. Ze beschrijven niet de zakelijke bedoeling van een specifieke taak.
‘Schoon de pipeline op’ kan betekenen: opmaak herstellen, verouderde deals opsporen, afsluitingen aanbevelen of deals sluiten. Een capabele agent kan een redelijke interpretatie kiezen die toch niet de bedoeling van de salesleider was. Meer intelligentie neemt die kloof niet weg. Ze kan de onbedoelde actie samenhangender en uitgebreider maken.
Een productiesysteem heeft daarom twee grenzen nodig: waartoe de agent toegang heeft en welke beslissingen hij in deze context mag nemen. Beide moeten smaller zijn dan de maximale mogelijkheden van de aangesloten tools.
Bepaal autonomie op basis van gevolgen, niet taakcomplexiteit.
Twintig accounts onderzoeken is complex, maar grotendeels omkeerbaar. Eén ongefundeerde prijsbelofte verzenden is eenvoudig, maar heeft gevolgen. Teams draaien die logica vaak om: ze voegen menselijke beoordeling toe aan alles wat intellectueel moeilijk lijkt, terwijl kleine operationele acties stilletjes de buitenwereld in mogen.
Classificeer acties naar de reikwijdte van hun gevolgen. Kan de actie worden teruggedraaid? Bereikt ze een klant? Verplaatst ze geld, verandert ze een juridische of commerciële toezegging, onthult ze privé-informatie of overschrijft ze bewijs dat iemand anders nodig heeft? De antwoorden moeten het niveau van goedkeuring en bewaking bepalen.
Zo kan de agent snel handelen waar experimenteren weinig kost, en vertragen waar vertrouwen kostbaar is.
- Lees en analyseer breed; schrijf beperkt.
- Geef voorrang aan concepten en aanbevelingen vóór externe acties.
- Vereis goedkeuring voor geld, beloften, verwijdering en klantcontact.
- Bewaar een auditspoor van bewijs, beslissingen en toolaanroepen.
- Geef elke live actie een verantwoordelijke en een herstelpad.
Ontwerp de grens voordat je de agent afstemt.
Veel teams beginnen met het model en voegen waarborgen toe nadat iets ongemakkelijks is gebeurd. Draai de volgorde om. Bepaal eerst de operationele grenzen en geef de agent vervolgens genoeg mogelijkheden om daarbinnen nuttig te zijn.
Scope → Toestemming → Drempel → Escalatie → Herstel
- 01Scope
Benoem het resultaat, de systemen, records en tijdshorizon die bij de taak horen.
- 02Toestemming
Scheid per tool de rechten om te lezen, concepten te maken, aanbevelingen te doen, te bewerken en uit te voeren.
- 03Drempel
Bepaal de waarde, zekerheid of impact waarbij autonomie stopt.
- 04Escalatie
Stuur uitzonderingen naar een aangewezen verantwoordelijke met context en een voorgestelde volgende stap.
- 05Herstel
Leg acties vast, bewaar de vorige toestand en maak wezenlijke wijzigingen waar mogelijk omkeerbaar.
Grenzen maken deel uit van de deterministische omhulling rond probabilistisch modelgedrag.
Stop met AI te vragen zich als software te gedragen.Betere grenzen kunnen minder goedkeuringsklikken betekenen.
Een mens elke actie laten goedkeuren lijkt veilig. In de praktijk leren herhaalde verzoeken mensen om door te klikken. De organisatie verplaatst verantwoordelijkheid naar een knop zonder betekenisvolle aandacht te creëren.
Een sterker ontwerp maakt routineacties met beperkte gevolgen veilig autonoom en reserveert menselijke aandacht voor ongewone, onomkeerbare of commercieel wezenlijke momenten. De agent moet bewijs, onzekerheid en een aanbevolen beslissing meebrengen – niet alleen een toestemmingsvakje.
Dat is het verschil tussen een mens in elke kringloop plaatsen en menselijke controle over het systeem behouden. Het ene creëert wrijving. Het andere creëert een grens waarop het bedrijf kan vertrouwen.
Vraag niet iemand elke stap te bewaken. Ontwerp het systeem zo dat diens aandacht terechtkomt bij de stappen die het resultaat kunnen veranderen.
Bewijs en verder lezen.
Een praktisch kader voor menselijke controle, rechten, verwachtingen, beveiliging, transparantie en privacy in agentische systemen.
02Anthropic: autonomie van AI-agents meten in de praktijkEmpirisch onderzoek naar rechten, menselijke tussenkomst, omkeerbare acties en toezicht na ingebruikname.
03Anthropic: ons kader voor veilige en betrouwbare agentsDe centrale ontwerpspanning tussen nuttige autonomie en betekenisvolle menselijke controle.