Artikel
Hoeveel kost een AI-agent voor een bedrijf
Een vermeld abonnement is nooit de volledige kostprijs van een AI-agent. Dit zijn de werkelijke uitgavenposten, met tarieven geverifieerd op 4 september 2026.
De vermelde prijs is niet de betaalde prijs
Wanneer men vraagt hoeveel een AI-agent kost, is het eerste antwoord dat opkomt bijna altijd een maandelijks abonnement. Dat is onvolledig. Een autonome AI-agent in productie telt meerdere kostenposten op die nooit op dezelfde factuur staan: de model-inferentie, het platformabonnement, de integratietijd, het menselijk toezicht, en het onderhoud over de tijd. EY vat het probleem in een analyse over tokenkosten in bedrijven goed samen: deze totale kosten blijven structureel onzichtbaar, omdat ze verspreid zitten over meerdere budgetten die nooit op dezelfde plek worden geconsolideerd (bron: EY, "Agentic AI enterprise token costs", https://www.ey.com/en_us/insights/ai/agentic-ai-token-costs, geraadpleegd op 2026-09-04).
Post 1: LLM-inferentie, de tokenprijs
Dit is de meest zichtbare post, en de meest verkeerd begrepen. Elke overweging van een agent (planning, beslissing, tool-aanroep) verbruikt tokens, gefactureerd door modelleveranciers per miljoen tokens, met een andere prijs voor invoer (wat naar het model wordt gestuurd) en uitvoer (wat het produceert). Hier zijn de publieke tarieven zoals ze op 4 september 2026 werden vermeld.
Op de Anthropic API (bron: Claude, tariefpagina, https://claude.com/pricing, geraadpleegd op 2026-09-04): Claude Haiku 4.5 kost 1 dollar per miljoen tokens in invoer en 5 dollar in uitvoer. Claude Sonnet 5 kost 2 dollar in invoer en 10 dollar in uitvoer. Claude Opus 5, het meest capabele model, kost 5 dollar in invoer en 25 dollar in uitvoer.
Op de OpenAI API (bron: OpenAI, tariefdocumentatie, https://developers.openai.com/api/docs/pricing, geraadpleegd op 2026-09-04): GPT-5 kost 1,25 dollar in invoer en 10 dollar in uitvoer. GPT-5.4 kost 2,50 dollar in invoer en 15 dollar in uitvoer. GPT-5.5 kost 5 dollar in invoer en 30 dollar in uitvoer.
Deze cijfers geven een orde van grootte, geen definitief budget: een agent die plant, meerdere tools aanroept en zijn eigen resultaten herleest, kan enkele tienduizenden tokens verbruiken voor één enkele taak. EY illustreert deze verschuiving met een voorbeeld dat het zelf presenteert als illustratie, niet als geverifieerd marktgemiddelde: een klantgesprek dat in 2023 0,04 dollar kostte, kost nu ongeveer 1,20 dollar in 2026, een vermenigvuldiging met 30 door de toenemende complexiteit van agentorkestraties (dezelfde bron als hierboven). Dat maakt de BYOK-optie net interessant voor bedrijven die deze post onder controle willen houden: BYOK maakt het mogelijk rechtstreeks uw eigen API-sleutel van een inferentieleverancier te koppelen, met een facturatie die dan het tarief van de gekozen leverancier volgt in plaats van een creditpakket.
Een punt dat vaak vergeten wordt in deze berekening: de prijs per miljoen tokens zegt niets over het werkelijke volume dat een agent verbruikt. Een supportagent die in één keer een eenvoudige vraag beantwoordt, verbruikt weinig. Een agent die een taak plant, drie tools aanroept, zijn resultaten herleest en zijn eigen concept corrigeert, kan dat volume met tien tot twintig vermenigvuldigen voor één enkel verzoek. Het is dit mechanisme, meer dan het opgegeven leverancierstarief, dat verklaart waarom de inferentiefactuur van een agent in productie vaak onaangenaam verrast wie zijn project alleen op basis van de cataloguprijs heeft becijferd.
Post 2: het platform en de slots
Bovenop de inferentie komen de kosten van het platform zelf: de omgeving die de agent host, zijn rechten beheert, zijn toolverbindingen, zijn geschiedenis en zijn observability. Dat is niet hetzelfde als de tokenprijs, het is de prijs van de infrastructuur die de agent dagelijks bruikbaar en bestuurbaar maakt, in plaats van een simpel script dat een model-API aanroept. Bij Atako wordt deze post gefactureerd per actieve agent, met een maandelijkse inferentiecreditbuffer inbegrepen. De exacte details van de tariefschijven staan op de prijzenpagina. Dit is een gangbaar model bij agentplatformen: u betaalt voor capaciteit, hoeveel agents tegelijk kunnen draaien, niet voor het aantal medewerkers dat ze gebruikt.
Post 3: integratie met bestaande tools
Een agent die alleen met zichzelf praat, heeft geen enkele waarde. Hij moet een CRM kunnen lezen, in een ticketingtool kunnen schrijven, in een discussiekanaal kunnen posten. Elke verbinding vraagt configuratie: API- of OAuth-toegang aanmaken, precies bepalen wat de agent mag doen, niet alleen waartoe hij toegang heeft, en vervolgens testen dat het werkt op echte gevallen. Dit werk wordt vaak onderschat bij de eerste raming van een project, terwijl het rechtstreeks bepaalt of de agent echt nuttig is, of een gadget blijft dat er goed uitziet in een demo maar nooit de echte systemen van het bedrijf raakt.
Deze post verschilt enorm naargelang het aantal te koppelen tools en hun complexiteit. Een agent aansluiten op één goed gedocumenteerd systeem, met eenvoudige API-sleutelauthenticatie, kost enkele uren. Bij meerdere verbindingen, met systemen die elk hun eigen configuratie vereisen (subdomein, regio, objectspecifieke rechten), loopt deze post veel sneller op dan het aantal tools zou doen vermoeden. Dit is een van de argumenten voor een platform dat al een uitgebreide catalogus kant-en-klare connectoren heeft geïndustrialiseerd, in plaats van elke integratie intern opnieuw te bouwen.
Post 4: menselijk toezicht
Een autonome agent is geen agent zonder controle. De gevoeligste acties, een koude e-mail sturen naar een klant, publieke content publiceren, factuurgegevens aanpassen, verdienen een punt van menselijke goedkeuring vóór uitvoering, althans bij de start. Deze toezichtstijd heeft een reële kostprijs, vaak in uren van medewerkers die het werk van de agent nalezen, valideren of corrigeren. Die kost neemt normaal af naarmate het vertrouwen groeit, maar verdwijnt nooit volledig: governance en vangrails maken deel uit van de totale kosten, niet van een optioneel extraatje. Dit is ook een van de factoren die Gartner aanhaalt om te verklaren waarom meer dan 40% van de agentische AI-projecten tegen eind 2027 zou worden stopgezet: onderschatte kosten voor governance en risicobeheersing bij de start (bron: Gartner, "Gartner Predicts Over 40% of Agentic AI Projects Will Be Canceled by End of 2027", https://www.gartner.com/en/newsroom/press-releases/2025-06-25-gartner-predicts-over-40-percent-of-agentic-ai-projects-will-be-canceled-by-end-of-2027, geraadpleegd op 2026-09-04).
Post 5: onderhoud over de tijd
Een geïmplementeerde agent is nooit af. De instructies die u hem geeft, moeten worden bijgesteld wanneer een proces verandert. Connectors breken wanneer een externe leverancier zijn API aanpast. Activiteitenlogs moeten worden bewaakt om afwijkingen te signaleren voordat ze incidenten worden. Deze onderhoudspost wordt door projectverantwoordelijken het meest systematisch vergeten bij het opstellen van een budget, omdat hij niet zichtbaar is bij de lancering: hij betaalt zich maand na maand uit, in de vorm van tijd van een engineer of beheerder die een oogje in het zeil houdt.
Zelf bouwen of via een platform werken
Tegenover deze lijst staan twee wegen open. Intern bouwen: zelf de modelaanroep, het rechtenbeheer, de observability en de connectoren samenbrengen, met een toegewijd technisch team. Of via een platform werken dat deze bouwstenen al heeft geïndustrialiseerd, en een abonnement per agent factureert in plaats van een op maat gemaakt engineeringproject. De keuze hangt vooral af van het beoogde aantal agents en hoe zeldzaam de use cases zijn: hoe standaarder de behoeften (support, HR, monitoring), hoe minder maatwerk gerechtvaardigd is. Deze vergelijking wordt verder uitgewerkt in een apart artikel. In elk geval is het beter om, voordat u beslist, een realistische raming te hebben van de vijf posten hierboven, in plaats van één abonnementsprijs die groot op een marketingpagina staat.
Veelgestelde vragen
Wat is de gemiddelde kost van een AI-agent voor een bedrijf?
Er bestaat geen betrouwbaar en onderbouwd gemiddelde, omdat de kosten afhangen van het gebruiksvolume, het gekozen model en het aantal integraties. Wat wel te becijferen valt, zijn de componenten: de tokenprijs (van 1 tot 5 dollar per miljoen invoertokens naargelang het model), het platformabonnement, en de tijd voor integratie en menselijk toezicht, die sterk verschillen van project tot project.
Hangt de prijs van een AI-agent af van het aantal gebruikers dat hem inzet?
Niet rechtstreeks bij de meeste huidige agentplatformen, waar de facturatie het aantal actieve agents volgt in plaats van het aantal personen dat ze gebruikt. Een agent die door een heel team wordt gedeeld, kost dus niet meer dan een agent die door één persoon wordt gebruikt, zolang de verwerkingscapaciteit (het aantal slots) gelijk blijft.
Wat is BYOK en waarom verandert dat de kostenberekening?
BYOK staat voor Bring Your Own Key: het bedrijf koppelt zijn eigen API-sleutel van een modelleverancier in plaats van de modellen te gebruiken die in het platformabonnement zijn inbegrepen. De inferentiekosten volgen dan rechtstreeks het tarief van de gekozen leverancier, zonder via een creditpakket te lopen, wat voordeliger kan zijn bij zeer hoog volume.
Waarom overschrijden AI-agentprojecten vaak hun oorspronkelijke budget?
Meestal omdat de eerste raming alleen het abonnement of de tokenkosten meerekent, en de integratie met bestaande tools, het menselijk toezicht en het onderhoud over de tijd vergeet. Deze posten vormen een aanzienlijk deel van de werkelijke kosten en betalen zich uit over de tijd, niet alleen bij de lancering.
Is het beter om een AI-agent intern te bouwen of via een platform te werken?
Dat hangt af van het aantal agents dat het bedrijf nodig heeft en van hoe gestandaardiseerd de use cases zijn. Voor een eenmalige of zeer specifieke behoefte kan een toegewijd technisch team zinvol zijn. Voor veelvoorkomende use cases zoals klantenservice of HR-operaties komt een platform dat inferentie, rechten en observability al heeft geïndustrialiseerd doorgaans goedkoper uit dan een op maat gemaakt engineeringproject.
Wat hierna te lezen
Bronnen
- Claude, tariefpagina van de API · geraadpleegd op 4 september 2026
- OpenAI, tariefdocumentatie van de API · geraadpleegd op 4 september 2026
- EY, Agentic AI enterprise token costs · geraadpleegd op 4 september 2026
- Gartner, Gartner Predicts Over 40% of Agentic AI Projects Will Be Canceled by End of 2027 · geraadpleegd op 4 september 2026
- Atako, prijzenpagina · geraadpleegd op 4 september 2026
CTO bij Atako
Deze inhoud is geschreven door de AI-agents van Atako en vervolgens nagelezen, gecorrigeerd en goedgekeurd door Romain Laodicina, CTO van Atako.