Naar de inhoud
Terug naar overzicht
AI NieuwsAgentsKostenOpenRouter

AI-agents verstoken vijf keer meer tokens dan mensen

·Door
AI-agents verstoken vijf keer meer tokens dan mensen

Zes februari 2026 was waarschijnlijk de laatste dag dat mensen meer AI verbruikten dan machines. Dat is geen filosofische uitspraak maar een aflezing van een teller.

Op OpenRouter, de dienst waar ontwikkelaars honderden modellen via één API aanspreken, liep het tokenverbruik van agents in dat weekend voorbij aan dat van mensen. Sindsdien is het gat opengetrokken tot ruim vijf keer.

"February 6th, 2026: potentially the last day humans consumed more tokens than AI agents."

— Peter Walker, data-analist bij OpenRouter (post met de grafiek)

Van een half biljoen naar 7,3 biljoen

De getallen staan op een zevendaags gemiddelde. In februari draaiden de agents 0,51 biljoen tokens per week. Op 10 augustus was dat 7,3 biljoen. Veertien keer zoveel, in een half jaar.

Het menselijke verkeer bewoog in diezelfde maanden van ongeveer een half biljoen naar 1,4 biljoen. Ook groei, maar van een andere orde: 2,8 keer.

Eén opdracht, dertig modelaanroepen

Het verschil zit in hoe een agent werkt. Jij typt een vraag en leest een antwoord. Een agent krijgt een opdracht, hakt hem in stappen, leest bestanden, roept gereedschap aan, controleert zijn eigen werk en begint opnieuw als het misgaat. Elke ronde stuurt de hele context weer mee.

OpenRouter rekende uit dat een agent-verzoek daardoor ongeveer vijftien keer meer tokens verbruikt dan een verzoek van een mens. Zet je een redeneermodel in, dat eerst een tijdje nadenkt voor het antwoordt, dan komt dat er nog bovenop.

Dat verklaart ook waar dat verkeer naartoe loopt. Wie miljarden tokens per dag verstookt, kiest geen duur topmodel maar het goedkoopste model dat de klus haalt. Op OpenRouter ging het aandeel van DeepSeek in het maandelijkse tokenvolume tussen januari en juni van 9,1 naar 18,1 procent, terwijl OpenAI zakte van 12,5 naar 7,4 procent.

Grafiek van OpenRouter: aandeel in maandelijks tokenvolume per modelmaker, januari 2026 tegenover juni 2026

De cache dempt de rekening

Voor je nu je AI-budget maal veertien doet: dat hoeft niet. Bijna zeventig procent van de agent-tokens komt uit gecachete prompts. Een agent stuurt keer op keer dezelfde context mee, en die wordt tegen een fors lager tarief afgerekend dan verse invoer.

Het ruwe volume vertelt dus niet wat je betaalt. Wat het wel vertelt: je kostenpost verschuift van "hoeveel collega's gebruiken ChatGPT" naar "hoeveel processen draaien er onbewaakt door". Dat eerste schaalt met je personeelsbestand. Het tweede met niets.

Twee dingen om erbij te zeggen. Deze cijfers komen van OpenRouter zelf, en niemand heeft ze nagerekend. En OpenRouter is geen doorsnede van de markt: het platform trekt vooral bouwers die open modellen inzetten, en die modellen zijn minder zuinig met tokens dan die van OpenAI of Anthropic. Wie rechtstreeks bij een lab afneemt, zit niet in deze meting.

Volgende Stap

Draait er al iets agentisch in je organisatie, dan is er één getal dat je vandaag kunt opzoeken: het tokenverbruik per taak, niet per maand. Een maandfactuur verbergt dat één slecht ingerichte agent in een nacht meer verstookt dan je hele team in een week.

Zet daar een limiet op voor je het schaalt. Vrijwel elk platform kan een uitgavenplafond per project of per sleutel afdwingen, en dat is een instelling van vijf minuten. Wil je weten waar in jouw processen agents wél lonen en waar ze alleen tokens verbranden, neem dan contact op.

Headerbeeld: The Decoder. Grafiek: OpenRouter.

Hoe AI-ready is jouw organisatie?

Doe de gratis AI-Readiness Scan: 9 vragen, 2 minuten, direct een persoonlijk advies.