AI-systemen Onderzoeksartikel

Wat is een AI-agent? Een definitie die founders kunnen gebruiken

Als het een tool call niet kan weigeren, is het geen agent. Het is een demo die je geld kan uitgeven.

Robotgrijper naar een blanco kaart in een gouden minibar terwijl een vinger een rode weigerknop indrukt
Als het een toolaanroep niet kan weigeren, is het een demo die kan uitgeven.

Een founder zegt “we hebben agents” en bedoelt daarmee meestal een van drie verschillende systemen. Door ze door elkaar te halen krijgt een chatvenster ineens productie-credentials.

Drie tests

Stel drie vragen aan het systeem dat voor je staat.

  1. Heeft het een doel dat langer dan één prompt overleeft?
  2. Kan het tools gebruiken (bestanden, mail, een browser, een repo, een betaal-API) zonder dat jij de output weer hoeft terug te plakken?
  3. Gaat het verder over meerdere stappen wanneer een tool iets rommeligs teruggeeft?

Als het antwoord nee, nee, nee is, heb je een chatbot. Dat is een respectabel product. Het is geen agent.

Als het antwoord nee, ja, nee is, heb je automatisering: een script met ergens een model in de pijplijn. Ook respectabel. Nog steeds geen agent.

Als het antwoord ja, ja, ja is, heb je iets dat kan handelen. Nu is de enige vraag die ertoe doet of iemand het plafond op papier heeft gezet.

In die ja’s zit een vierde nee verborgen. Kan het een tool-call weigeren? Als het niet kan stoppen, heb je geen werknemer. Je hebt een lont.

Chatbot, automatisering, agent

Een chatbot reageert op jouw beurt. Jij typt. Hij antwoordt. Het contextvenster is het geheugen. Zodra je het tabblad sluit, is het werk weg tenzij je het hebt opgeslagen. Handig voor het maken van een eerste opzet. Gevaarlijk zodra je zijn output in een tool plakt die hij zelf niet kan zien.

Een automatisering volgt een vast pad. Een ticket komt binnen, velden worden ingevuld, Slack geeft een ping. Misschien classificeert een model het ticket. Het pad verzint geen nieuw pad. Als het faalt, faalt het op een plek die je kunt aanwijzen in een diagram. Een agentic workflow is niet hetzelfde als een automatisering. Een script dat een model aanroept, blijft gewoon een script.

Een AI agent pakt een doel op, kiest tools en gaat door. Dat is de werkbare definitie voor operators. Het is ook de gevaarlijke. Een agent die kan mailen, geld kan uitgeven of een pull request kan openen, is geen “AI”. Het is een junior medewerker zonder arbeidscontract.

Haal één object door de drie hokjes. “Vat deze PDF samen in de chat” is een chatbot. “Wanneer er een PDF in deze map landt, haal het factuurbedrag eruit en zet het in de sheet” is automatisering. “Ga deze week achter onbetaalde facturen aan met de sheet en de mail-tool, en stop als een klant protesteert” is een agent, maar alleen als iemand die stop daadwerkelijk heeft geschreven.

De begrippencapsule is de korte versie. Deze pagina is de test die je in een meeting uitvoert.

Het charter is de definitie

Ik noem een systeem pas een agent als het een geschreven charter heeft. Zeven velden, precies dezelfde die ik gebruik voor menselijke operators in CHORUS:

  • Doel
  • Input
  • Output
  • Autoriteitsplafond
  • Succescriteria
  • Review
  • Escalatie

Als je die velden niet kunt invullen, heb je geen agent. Je hebt een demo. Demo’s zijn toegestaan. Demo’s krijgen alleen niet de productie-sleutel.

Ingevuld, voor de facturatie-medewerker:

  • Doel. Deze week openstaande facturen innen zonder een juridisch gevecht te starten.
  • Input. De debiteurensheet van vandaag. De laatst goedgekeurde template voor herinneringen.
  • Output. Een verzendklare conceptmail per openstaande regel, of een overgeslagen regel mét een reden.
  • Autoriteitsplafond. Alleen concepten maken. Niet verzenden. Geen nieuwe kortingen geven. Geen juridische stappen beloven.
  • Succescriteria. Elk concept vermeldt het factuurnummer en het exacte bedrag. Overslaan is legitiem als de regel wordt betwist.
  • Review. De founder keurt elk concept af dat zelf een boete verzint of de vervaldatum verandert.
  • Escalatie. Alles wat lijkt op een conflict gaat naar de founder voordat er een tweede concept wordt gemaakt.

Dat zijn zeven velden. Geen zes (dat is een handoff-pakket). Geen vier (dat is een slogan). De CHORUS charter-lijn hanteert dezelfde lijst voor een mens als voor een agent.

De human in the loop is geen persoon die af en toe met een schuin oog naar een dashboard kijkt. Het is een benoemde reviewer die de output kan afkeuren op basis van de succescriteria. Geen benoemde reviewer, geen loop.

De override-doctrine is de andere helft van het charter. Het charter beschrijft wat de agent doet. De doctrine bepaalt wat hij moet weigeren: meer uitgeven dan een bepaald plafond, spreken namens het bedrijf, productiedata wijzigen, of een oordeel vellen dat nog steeds bij jou hoort te liggen.

MCP bepaalt hoe die werknemer het pand mag aanraken: zichtbaarheid, mutatie, logboek. Het is niet de definitie van de werknemer. Een schone server zonder charter is nog steeds een gat, maar dan met beter leidingwerk.

Waar dit in de bibliotheek thuishoort

SENSE bepaalt waar een agent in de week van een founder thuishoort: welk signaal een permanent systeem waard is, welke claim een betrouwbaarheidsscore nodig heeft, welke beslissing op maandag verandert. De 90-dagen kalender is Diagnose, Deploy, Evaluate. AI Agents for Startup Strategy is het boek dat die laag installeert.

Waarom multi-agent systemen falen laat zien wat er gebeurt als je drie van dit soort werknemers toevoegt en het protocol overslaat. Capaciteit is goedkoop. Coördinatie is dat niet.

STACK is de volgende deur. Zodra je een echte agent hebt, begint de repo waarin hij leeft te rotten, tenzij het agent-OS op dezelfde manier geversioneerd wordt als de app. Dat is weer een ander artikel.

Deze pagina verkoopt je geen runtime. Runtimes veranderen van naam. De drie tests en het charter niet.

Een audit van vijf minuten

Kies één systeem dat je nu al een agent noemt.

  1. Schrijf het doel op in één zin die morgen ook nog logisch is.
  2. Maak een lijst van de tools die het mag aanraken. Als het antwoord “wat er ook maar in de plugin-lijst staat” is, heb je geen lijst.
  3. Noem de mens die een aanroep kan stoppen. Een rol is geen naam.
  4. Schrijf de ene actie op die hij absoluut niet mag uitvoeren.
  5. Schrijf op wanneer die persoon voor het laatst daadwerkelijk een output heeft afgekeurd.

Als een van die regels leeg blijft, stop dan met het woord agent te gebruiken voor dat systeem totdat je de regel hebt ingevuld. Het vocabulaire is je controlemechanisme. Een slordig vocabulaire is hoe een chatbot een API-key in handen krijgt.

Begrippen

Bronnen

  1. AI-agent (begrippenlijst)
  2. SENSE framework
  3. AI Agents for Startup Strategy

Verder lezen

Markdown voor LLMs