AI duurder dan personeel? Bespaar nu met open Chinese modellen!

augustus 18, 2026

Hand op laptop toetsenbord met dalende geldmunten die AI-kosten symboliseren

De kosten voor het inzetten van AI door werknemers kunnen soms hoger uitvallen dan hun maandelijkse loon. Maar is het nodig om afhankelijk te zijn van Amerikaanse technologiebedrijven die hun prijzen kunnen dicteren? Volgens deskundigen niet, omdat er voldoende alternatieve AI-modellen beschikbaar zijn, met name uit China, die de competitie met Amerika aangaan en de kosten drukken.

De organisaties achter bekende AI-systemen zoals ChatGPT, Claude en Gemini investeren ook dit jaar weer miljarden in de strijd om een vooraanstaande positie binnen de software-industrie die de wereld transformeert. Deze investeringen zullen zij voorlopig niet terugverdienen, hoewel de eerste stappen daartoe worden gezet.

Beginnende gebruikers kunnen vaak al uit de voeten met een basisabonnement van ongeveer 25 euro per maand. OpenAI, Anthropic en andere aanbieders bieden echter ook toegang tot hun uitgebreidere LLM’s (Large Language Models) aan, waarbij de prijzen starten vanaf 200 euro. Voor de meer intensieve gebruikers, zoals softwareontwikkelaars, begint het financiële plaatje echter pas echt interessant te worden.

Grote AI-leveranciers rekenen niet langer per maand, maar per gebruik. De energie die de dure chips in hun datacenters verbruiken moet immers betaald worden. Dit gebruik wordt bijgehouden met zogenaamde tokens, waarbij een token een stukje tekst is dat door het AI-model wordt gegenereerd of dat als input dient voor een taak, vaak niet eens een volledig woord. Er wordt per miljoen tokens afgerekend.

Bijvoorbeeld, je betaalt ongeveer 5 dollar per miljoen tokens die je gebruikt in GPT 5.5 voor bekende prompts, en 30 dollar voor elke miljoen tokens die het OpenAI-model als output genereert. Anthropic hanteert vergelijkbare prijzen en Google zit met Gemini iets lager. Dit zijn de tarieven voor hun topmodellen; oudere en eenvoudigere modellen zijn veelal goedkoper.

AI-agents laten de kosten oplopen

Het loopt snel op, zeker met de opkomst van AI-agents, AI-systemen die zelfstandig taken uitvoeren. In het afgelopen jaar hebben softwareontwikkelaars kunnen ervaren hoe AI steeds beter wordt in het schrijven, testen en opschonen van software. Agents zoals Claude Code, Cursor en OpenAI Codex worden steeds vaker en intensiever ingezet. Deze agents verbruiken continu tokens, indien nodig 24 uur per dag, 7 dagen per week.

Programmeur werkend aan code met AI-agents in geautomatiseerde workflows
AI-agents voeren taken automatisch uit, maar verbruiken continu tokens en drijven kosten omhoog.

En wie betaalt dat? De werkgever. De kosten voor tokens en abonnementen waar werknemers mee werken, kunnen tegen 2028 zelfs hoger zijn dan het salaris van een gemiddelde programmeur in India, aldus onderzoeksbureau Gartner. Op dit moment geeft een kwart van de ondervraagde IT-managers hun programmeurs een budget van 200 tot 500 dollar per maand, maar dit kan oplopen tot 2000 dollar. Al 6 procent van de techleiders die Gartner ondervroeg geeft meer dan 2000 dollar uit per ontwikkelaar.

De totale AI-budgetten beginnen uit de hand te lopen en bedrijven vragen zich af of ze wel waar voor hun geld krijgen. Duizenden medewerkers van Microsoft moesten eind juni stoppen met het gebruik van Claude Code omdat de kosten te hoog opliepen. En dan zijn er nog de incidenten bij organisaties die vergeten een limiet in te stellen voor het tokenverbruik van hun werknemers en AI agents. Zoals bij Amazon, dat geen klein bedrijf is, waar de rekening voor een mislukt project opliep tot 1.8 miljoen dollar, zonder dat iemand het merkte.

LEES  Topartikelen: Heineken's Hoofdpijndossiers & Alarmerend Cybersecurity Gesprek!

Controle over kosten en AI-soevereiniteit

Op dit moment subsidiëren de grote AI-spelers hun diensten nog deels, volgens het bekende model van de heroïnedealer: de eerste doses zijn gratis, maar zodra je afhankelijk bent, wordt de volle prijs gerekend. Hoe voorkom je als organisatie dat je financieel uitgeput raakt door een AI-verslaving?

Er zijn twee belangrijke maatregelen: zorg ervoor dat de kosten niet te hoog oplopen en voorkom tegelijkertijd afhankelijkheid van één groot AI-model. Met andere woorden: werk aan je AI-soevereiniteit.

De Nederlandse scale-up orq.ai heeft software ontwikkeld die organisaties helpt om beter grip te krijgen op het AI-gebruik door hun medewerkers. Grotere bedrijven gebruiken inmiddels tientallen AI-modellen, niet alleen uit Amerika maar ook uit China. Medewerkers kunnen samen veilig werken aan prompts en experimenten, terwijl orq.ai inzicht biedt in de kosten.

Schakelen tussen AI-modellen

Je kunt de kosten beheersen door je medewerkers een tokenbudget te geven. Sohrab Hosseini, oprichter van orq.ai: ‘We besteden zelf duizenden euro’s per maand, maar de productiviteit die we daarmee bereiken is enorm. Een goede ontwikkelaar kan tien keer zoveel opleveren, het is bijna als doping.’

Daarom is het misschien nog belangrijker om het juiste AI-model te kiezen voor elke specifieke taak. Dat is waarom de LLM-router die orq.ai dit jaar lanceerde zo populair is. ‘Grote bedrijven implementeren tegenwoordig allemaal dat concept van een slimme router: automatisch schakelen tussen modellen op basis van kosten en benodigde intelligentie.’

Maar je moet wel goed weten waar je mee werkt. ‘Controle houden over AI is als het temmen van een veelkoppig monster, met kosten, kwaliteit, snelheid, privacy en veiligheid als voorwaarden die je op orde moet hebben. Veel draait om controle en governance.’ Hosseini’s software geeft waarschuwingen als de kosten uit de hand lopen of als er een datalek dreigt.

Eerst een budget, dan pas experimenteren

Stel vooraf een AI-budget vast en geef niet zomaar iedereen toegang tot de zwaarste en duurste modellen, adviseert Hosseini. ‘De marketingafdeling heeft geen bleeding edge model nodig voor wat testjes, maar de R&D-afdeling mag misschien wel miljoenen per maand besteden.’ Inmiddels worden taken ook verdeeld in subtaken die worden toegewezen aan een kleiner en goedkoper AI-model en complexer werk voor de zwaarste modellen.

Vaak genoeg ziet hij dat bedrijven het strakker aansturen nadat ze een ‘bloedneus’ hebben opgelopen met AI. ‘Dan blijkt iemand tijdens het weekend 80.000 dollar te hebben verbrand met een agent, iets waar je pas op maandag achterkomt. Of heeft een agent data laten lekken.’

Ook als je het AI-monster weet te temmen, zullen de tarieven oplopen, schat Hosseini in. ‘Ik vergelijk het met Uber. Daarmee kon je in het begin ook voor 15 euro naar Schiphol vanuit Amsterdam. De eerste jaren subsidiëren die bedrijven hun diensten, maar de miljarden moeten een keer worden terugverdiend.’

LEES  CEO Fernandez onthult: Unilever binnenkort tweede grootste in beauty en persoonlijke verzorging!

China zet de markt op scherp

Maar nu de olifant in de kamer: de Chinese modellen. Sinds DeepSeek begin 2025 met een taalmodel kwam dat bijna net zo goed werkt als dat van de Amerikanen, maar veel minder rekenkracht nodig had en daardoor goedkoper werkte, zijn de spelregels veranderd. Qwen van Alibaba, MiMo van Xiaomi, GLM van Z.ai: Chinese aanbieders brengen het ene model na het andere uit, en de prestaties komen zeker de afgelopen maanden verbluffend dicht bij die van de snelste Amerikaanse AI.

Moderne datacenters en technologische infrastructuur die Chinese AI-modellen ondersteunen
Chinese AI-modellen zoals DeepSeek bieden competitieve prijzen en drukken de markt.

Sterker nog: de Chinezen gaan de AI-race winnen als het zo doorgaat. Dat zei Clément Delangue deze week, ceo van platform voor AI-ontwikkelaars Hugging Face. Dat komt vooral doordat de Chinese AI-software als ‘open weight’ wordt aangeboden: een soort open source-light, waarbij de gebruiker het model mag downloaden om er kleine aanpassingen aan te doen en inzicht krijgt in de manier waarop het is getraind. Die open aanpak is volgens hem de winnende, zeker als de Amerikanen blijven werken in gesloten silo’s.

Rekenkracht blijft duur

Kosten spelen daarin een cruciale rol. Nog steeds kost rekenkracht geld: de gpu’s in al die AI datacenters zijn duur en vreten stroom. ‘Maar de tokens van Chinese modellen kosten soms een honderdste van wat je bij de Amerikanen kwijt bent’, zegt Hosseini.

Bij OpenRouter, ook een service waarmee gebruikers toegang krijgen tot LLM’s, wordt de top 10 van populairste modellen gedomineerd door Chinezen. Alleen voor OpenAI’s GPT 5.6 is nog een plekje – Claude verdween uit de top.

David Schrooten is cto van Akela Hub, dat toepassingen bouwt voor recruiters en business development, en gaat in de AI-wereld al veel langer terug dan de opkomst van ChatGPT. Ook hij houdt de Chinese aanbieders in de gaten. ‘Het speelveld is totaal veranderd. Ik was eerder sceptisch, maar sinds dit jaar programmeren we ook met AI en ik test regelmatig ook de Chinese modellen die uitkomen.’

Dan blijkt wel: ‘gratis’ gebruik van die software op je eigen of gehuurde hardware kan flink in de papieren lopen. ‘Dan blijkt ook wel waarom die grote bedrijven megaverliezen maken. Het kost mij 110 dollar per uur om bijvoorbeeld GLM 5.2 te draaien. Dat doe ik alleen als ik heel zware taken te doen heb.’

Soevereiniteit als verkoopargument

Inmiddels beperkt de Chinese opmars de ruimte voor OpenAI en Anthropic om hun prijzen al te drastisch te blijven verhogen. Maar dat is te weinig aanleiding om zaken te blijven doen met (alleen) Amerikanen. Je wilt zoals bij alle leveranciers een lock-in voorkomen. Vanwege hun prijszettingsmacht, maar helaas ook om voorbereid te zijn op het moment dat ‘de stekker eruit gaat’ voor Europese klanten van de Amerikaanse big tech.

Het is precies waarmee Daan Witte tegenwoordig klanten wint: zijn bedrijf belooft soevereine oplossingen voor Nederland. Dat begon als Gradient voor ministeries en andere organisaties in de publieke sector, maar nu is er met Soev.ai ook een dochter die bedrijven bedient. Vaak lift het daarbij mee met aanbieders van Nederlandse clouddiensten. ‘We bouwden eerst toepassingen die lokaal draaiden, met open modellen, puur vanwege de veiligheid. Dat was voordat het echt uit de hand liep met Trump.’  

LEES  Miljoeneninvestering voor Rival Foods en The Protein Brewery: Oprichter zegt 'het kostte jaren van mijn leven'

Kosten en lock-in als verkoopargument

Inmiddels zijn kosten en lock-in ook verkoopargumenten voor Soev.ai. ‘Soms zijn klanten geschrokken van de rekening die ze krijgen van Microsoft Azure.’ Maar het moet niet alleen draaien om de kosten, zegt Witte. Stel dat je over een paar jaar bij 30-40 procent van je processen AI inzet, wil je dan afhankelijk zijn van één externe leverancier?

‘Het gevaar van geen controle hebben is niet eens zozeer dat Amerika zijn diensten uitzet’, zegt hij. ‘Wel dat de prijs straks keer 5 en keer 10 gaat.’

Soev.ai rekent op dit moment 35 euro per gebruiker. ‘Je wilt controle hebben over je data en software, over de functionaliteit van de AI en ook over de prijs. Uitgangspunt is dat we iets neerzetten wat net zo makkelijk werkt als de bekende Amerikaanse AI-diensten en hun agents, maar je kunt zelf kiezen waar het draait én je kunt naar een andere partij verhuizen zonder schade. We geven je alle handvaten om je data mee te nemen. Het reduceren van afhankelijkheid is namelijk de kern van de oplossing.’

Ook Chinese modellen in de mix

Daarbij zet Soev.ai voor elke taak het meest geschikte LLM in. ‘Voor het klaarzetten van een wekelijkse agenda heb je geen Claude Opus 4.8 nodig.’ En Chinese modellen? Zeker, zegt Witte. ‘Ze bieden ontzettend krachtige modellen, maar ook veel kleinere, die als ze op grote schaal ergens draaien veel goedkoper zijn. Met name bedrijven zijn daarin vrij pragmatisch, die willen efficiency en waar voor hun geld. Google en Nvidia bieden ook open weight modellen, maar andere Amerikaanse spelers weten dat ze met een antwoord moeten komen op de Chinese spelers.’

Cto Schrooten noemt het model K3 dat het Chinese Kimi vorige maand uitbracht, een ‘kaakslag voor de Amerikaanse techbedrijven’. ‘Met vergelijkbare prestaties als Claude Fable, terwijl iedereen het zelf kan draaien. Het verdienmodel van de Amerikanen was gebaseerd op dominantie waarmee ze de prijzen konden afdwingen. Er gaat de komende tijd veel veranderen.’

Vergelijkbare berichten

Beoordeel dit post

Plaats een reactie

Share to...