AI-systemen Onderzoeksartikel

Wat is een AI-agent? Een definitie die founders kunnen gebruiken

Als het een tool call niet kan weigeren, is het geen agent. Het is een demo die je geld kan uitgeven.

Notitieboek, koperen schakelaar en een verzegelde envelop op crèmekleurig papier
Een doel, een schakelaar en een verzegelde overdracht. Dat lijkt meer op een agent dan een chatvenster.

Als een founder zegt dat hij agents gebruikt, doelt hij meestal op een van drie totaal verschillende systemen. Die verwarring is precies de reden waarom een simpel chatvenster soms zomaar toegang krijgt tot je productiedata.

Drie tests

Stel drie vragen aan het systeem dat je voor je hebt.

  1. Heeft het een doel dat langer overleeft dan één enkele prompt?
  2. Kan het tools gebruiken (bestanden inzien, mailen, een browser besturen, een repo lezen of een betaal-API aanroepen) zonder dat jij de output steeds hoeft terug te plakken?
  3. Gaat het door met de volgende stap als een tool een rommelige foutmelding teruggeeft?

Als het antwoord nee, nee, nee is, heb je een chatbot. Dat is een prima product, maar het is geen agent.

Als het antwoord nee, ja, nee is, heb je een automatisering: een vast script met ergens een model in de pijplijn. Ook nuttig. Nog steeds geen agent.

Als het antwoord op alle drie ja is, heb je iets dat zelfstandig kan handelen. Nu is de enige vraag die er nog toe doet: heeft iemand het plafond opgeschreven?

Chatbot, automatisering, agent

Een chatbot werkt per beurt. Jij typt iets. Hij geeft antwoord. Het context window is zijn enige geheugen. Sluit je het tabblad, dan is het werk weg tenzij je het opslaat.

Een automatisering volgt een vaste route. Er komt een ticket binnen, velden worden ingevuld, je krijgt een ping in Slack. Misschien zit er ergens een model dat het ticket classificeert. Maar de route verzint geen nieuwe route. Als het faalt, gebeurt dat op een plek die je op een diagram kunt aanwijzen.

Een AI-agent pakt een doel, kiest de benodigde tools en gaat aan de slag. Dat is de definitie waar je als operator iets aan hebt. Het is direct ook de gevaarlijkste definitie. Een agent die e-mails verstuurt, geld uitgeeft of een pull request opent, is geen “AI”. Het is een junior medewerker zonder arbeidscontract.

De begrippenlijst geeft de korte versie. De tekst op deze pagina is de test die je in een meeting gebruikt.

Het charter is de definitie

Ik noem een systeem pas een agent als er een uitgeschreven charter ligt. Dat zijn zeven velden, precies dezelfde die ik in CHORUS gebruik voor menselijke operators:

  • doel
  • input
  • output
  • bevoegdheidsplafond
  • succescriteria
  • review-vereiste
  • escalatie

Als je die velden niet kunt invullen, heb je geen agent. Dan heb je een demo. Demo’s zijn prima. Maar demo’s krijgen niet de sleutel van de productie-omgeving.

De mens in de lus is niet zomaar iemand die toevallig naar een dashboard kijkt. Het is een aangewezen reviewer die de bevoegdheid heeft om het werk af te keuren op basis van de succescriteria. Geen aangewezen reviewer? Dan heb je ook geen loop.

De override doctrine vormt de andere helft van het charter. Het charter bepaalt wat de agent doet. De doctrine dicteert wat hij absoluut moet weigeren: uitgaven doen boven een bepaalde limiet, namens het bedrijf communiceren, productiedata wijzigen of een oordeel vellen waar jij verantwoordelijk voor hoort te zijn.

Waar dit past in de bibliotheek

SENSE bepaalt waar een agent thuishoort in de week van een founder: welk signaal een permanent systeem waard is, welke claim een betrouwbaarheidsscore nodig heeft, en welke maandagbeslissing de koers verandert. AI Agents for Startup Strategy is het boek dat die strategische laag installeert.

STACK is het volgende station. Zodra je een echte agent hebt draaien, begint de repo waarin hij leeft weg te rotten, tenzij je het agent OS net zo strak versioneert als je applicatie. Dat is voer voor een ander artikel.

Deze pagina probeert je geen specifieke runtime te verkopen. Runtimes veranderen continu van naam. De drie tests en het charter doen dat niet.

Een audit van vijf minuten

Kies één systeem dat je nu al een agent noemt. Schrijf het doel op in één zin. Maak een lijst van de tools waar het bij kan. Noem de mens die een call mag afbreken. Schrijf die ene actie op die absoluut verboden is.

Blijft er ook maar één regel leeg? Stop dan met het gebruiken van het woord agent voor dat systeem tot je de regel wel kunt invullen. De woordenschat is je controlemechanisme. Een slordige woordenschat is hoe een simpele chatbot per ongeluk de eigenaar van een API-key wordt.

Begrippen

Bronnen

  1. AI-agent (begrippenlijst)
  2. SENSE framework
  3. AI Agents for Startup Strategy

Verder lezen