Bij grote bedrijven komt er steeds vaker een harde grens aan het gebruik van AI-taalmodellen, code-assistenten en chatbots. Niet omdat de belangstelling weg is, maar omdat de rekening veel sneller oploopt dan gedacht. De tijd dat er intern nog werd opgeschept over wie de meeste AI-tokens had verstookt, lijkt daarmee wel voorbij.
Eerst kregen medewerkers juist het signaal om dit soort tools volop te gebruiken. Nu zie je op steeds meer plekken het omgekeerde gebeuren: minder tokenverbruik, strakkere regels. Waarom, laat zich raden. De kosten schieten harder omhoog dan veel bedrijven hadden ingecalculeerd. Bij sommige intensieve gebruikers loopt dat al op tot ongeveer 7.500 dollar per medewerker, per maand.
Vooral agentische tools tikken stevig aan. Binnen één workflow roepen die modellen steeds opnieuw aan, soms zonder dat het voor gebruikers direct zichtbaar is. In sommige gevallen heeft dat enterprise-rekeningen zelfs verdrievoudigd, terwijl de prijs per token intussen juist daalde. Dat kantelpunt komt precies op het moment dat bestuurders scherper naar rendement kijken. De wereldwijde uitgaven aan deze technologie zouden in 2026 uitkomen op 2,59 biljoen dollar, maar volgens Deloitte zegt wereldwijd slechts 28% van de financiële top daar nu al echt duidelijke, meetbare waarde uit te halen.
Geen wonder dus dat kostenbeheersing ineens hoog op de agenda staat. Een paar voorbeelden uit de markt:
- AT&T. Voor sommige teams is de toegang tot GitHub Copilot ingeperkt.
- Meta. Meta zou kritischer zijn gaan kijken naar wat het uitgeeft aan tools van Anthropic en andere leveranciers.
- Uber. Volgens berichten was het volledige budget voor codehulpmiddelen voor 2026 in april al op. Inmiddels geldt er een plafond van 1.500 dollar per medewerker per maand, per tool.
- Walmart. Ook daar is het gebruik van de interne AI-agent aan banden gelegd.
- Amazon. Amazon schrapte een intern klassement rond gebruik nadat medewerkers het systeem begonnen uit te buiten en de compute-kosten opliepen.
- Microsoft. Individuele engineers konden alleen al aan tokens voor Claude Code grofweg 500 tot 2.000 dollar per maand verbruiken.
Die voorbeelden staan niet op zichzelf. Je ziet breder dat bedrijven best willen blijven experimenteren, maar niet meer zonder hek eromheen. Budgetten, toegangsrechten en gebruikslimieten zijn daardoor steeds minder uitzonderingen. Op veel plekken worden ze gewoon standaardbeleid.
Al draait niet ieder bedrijf de kraan even ver dicht. Box zegt dat het hoog tokenverbruik nooit actief heeft aangemoedigd. Databricks zegt juist dat sommige engineeringbudgetten voor dit soort tools nog altijd ongelimiteerd zijn. Het verschil zit waarschijnlijk vooral in vertrouwen. Organisaties die hun workflows efficiënt hebben ingericht, voelen minder druk om meteen hard te gaan rantsoeneren.
Minder tokens verbruiken betekent trouwens niet vanzelf minder gebruik. Veel bedrijven proberen juist te besparen via slimmere modelrouting. Eenvoudige taken gaan dan naar kleinere, goedkopere of open-sourcemodellen. Alleen de lastigste opdrachten komen nog bij de duurdere frontier-modellen terecht.
Daarmee ontstaat intussen ook een nieuwe markt voor kostenbeheersing. Microsoft en Databricks hebben gateways uitgebracht om verbruik te volgen en plafonds af te dwingen. Factory, gesteund door Nvidia en gewaardeerd op 1,5 miljard dollar, kwam met een router die goedkopere taken automatisch naar goedkopere modellen stuurt.
En er kan nog meer prijsdruk aankomen. Ook OpenAI, de maker van ChatGPT, zou prijsverlagingen overwegen nu de concurrentie oploopt. De boodschap uit de markt is in elk geval helder: niet maximaal verstoken, maar zo efficiënt mogelijk inzetten. Voor veel bedrijven is dat inmiddels geen kwestie van finetunen meer. Het is gewoon noodzaak.
Bron: niet vermeld