5min Financieel

Bedrijven drukken AI-kosten met factor drie dankzij Chinese AI-modellen

Bedrijven drukken AI-kosten met factor drie dankzij Chinese AI-modellen

Steeds meer Nederlandse en Belgische bedrijven kiezen voor goedkopere Chinese AI-modellen zoals DeepSeek en Kimi. Volgens platform OpenRouter hebben die de Amerikaanse concurrentie inmiddels ingehaald in tokenverbruik. Ook in de Benelux drukken ondernemingen er hun operationele kosten mee, soms met een factor drie.

In de AI-wereld voltrekt zich een stille verschuiving. Amerikaanse giganten waren jarenlang de onbetwiste leveranciers van kunstmatige intelligentie aan de zakelijke markt. Bedrijven in Nederland en België wijken echter steeds vaker uit naar Chinese alternatieven, die niet alleen almaar beter worden, maar vooral ook een fractie kosten van hun westerse tegenhangers.

Volgens data van OpenRouter, een platform dat het gebruik van uiteenlopende taalmodellen bijhoudt, nemen Chinese modellen inmiddels zo’n 61 procent van de tokenconsumptie onder de tien populairste modellen voor hun rekening. Nauwelijks twee jaar geleden was dat nog ongeveer 1 procent. Tokens zijn de bekende, gangbare rekeneenheid voor de in- en output van een AI-model.

Factor drie goedkoper

AI-modellen kunnen steeds meer, maar bij complexe taken zoals grote codeeropdrachten gebruiken ze enorme hoeveelheden tokens. De facturen lopen daardoor snel op. Grote spelers als Uber, Amazon en Cisco haalden de voorbije maanden de broeksriem aan.

Chinese modellen blijven qua pure kwaliteit nog licht achter, maar dringen zich door de kosten nadrukkelijk op als alternatief. Ook Belgische bedrijven grijpen er steeds vaker naar, schrijft De Tijd. “Voor onze interne AI-assistent gebruiken we nu het model Kimi K2.6 op de Europese servers van Cloudflare”, zegt Xander Berkein, CTO van Donna. Sinds die overstap zijn de kosten voor eenvoudige taken als samenvatten en vertalen met een factor drie gedaald.

Steeds meer ondernemingen kiezen voor die mix: goedkope Chinese AI voor eenvoudig werk, duurdere Amerikaanse modellen voor het complexe deel. “Bij elke taak kijken we welk model volstaat om ze degelijk uit te voeren en we kiezen daarbij het goedkoopste, in plaats van standaard het duurste te kiezen omdat dat veilig voelt”, legt Laurens Logghe, CEO van softwarebedrijf Encima, uit. Voor het monnikenwerk, eindeloze lappen technische tekst, zet hij het goedkope DeepSeek in.

Dat prijsverschil is fors. Waar DeepSeek V4-Flash rond de 0,14 dollar per miljoen input-tokens kost, ligt het premium-model Kimi K3 volgens marktcijfers rond de 15 dollar per miljoen output-tokens. Toch is dat volgens een vergelijking van het cloudplatform Fireworks nog altijd tot 50 keer goedkoper dan het Amerikaanse topmodel Fable voor sommige tokenintensieve toepassingen.

Razendsnelle inhaalslag

De kwaliteitskloof slinkt wel snel. Zo werd enkele maanden geleden de achterstand op de VS nog op een jaar geraamd, een maand geleden was dat ongeveer zes maanden. Vorige week lanceerde start-up Moonshot het model Kimi K3, dat op sommige parameters even sterk scoort als Fable van Anthropic. “Dat toont toch aan dat we in een nieuwe fase komen”, zegt Berkein. “Wij gaan dit zeker testen.”

Een andere factor is de open weight-strategie van de Chinezen. Ontwikkelaars kunnen die modellen downloaden, inzien en aanpassen, iets wat bij de gesloten systemen van OpenAI, Anthropic en Google niet kan. Dat maakt ze flexibeler en het maakt datacontrole eenvoudiger. Je kunt ze immers op eigen servers of een Europese cloud draaien.

Lees ook: De stille dreiging van Shadow-AI op de werkvloer

Nederlandse markt: AVG en ‘model routing’

In Nederland is een vergelijkbare trend zichtbaar, al ligt de nadruk daar naast kostenbesparing minstens zo sterk op privacy en wetgeving. Direct data doorsturen naar servers in China ligt bij Nederlandse IT-directeuren en compliance-officers uiteraard gevoelig vanwege de AVG en strikte richtlijnen rond datasoevereiniteit.

De oplossing voor veel Nederlandse softwareontwikkelaars en enterprise-organisaties ligt in de open weight-natuur van deze modellen. Doordat de parameters openbaar zijn, worden Chinese modellen massaal uitgerold binnen de Europese Unie, bijvoorbeeld via EU-instances van Cloudflare en AWS, of op eigen servers. Zo profiteren bedrijven van de lage tokenprijzen zonder dat er data het Europese continent verlaat.

Daarnaast wint het concept van slimme model routing in Nederland snel terrein. Waar organisaties voorheen standaard al hun AI-taken doorstuurden naar één duur Amerikaans topmodel, worden verzoeken nu automatisch gefilterd op basis van complexiteit en gevoeligheid. Routineklussen zoals het samenvatten van documenten, data-extractie of het draaien van agentic-codeerlussen gaan naar efficiënte modellen als DeepSeek. Pas wanneer er zware redeneerstappen of gevoelige bedrijfsdata aan te pas komen, wordt er doorgeschakeld naar duurdere, gesloten modellen van bijvoorbeeld Anthropic of OpenAI.

Nerveuze Amerikanen

De opmars maakt de VS zenuwachtig. De Amerikaanse markten reageerden slecht op de lancering van Kimi K3, zeker met de geplande beursgangen van Anthropic en OpenAI in het vooruitzicht. Deze week circuleerden zelfs geruchten over een mogelijke Amerikaanse ban op Chinese AI. Een regeringsadviseur beschuldigde Moonshot van distillatie, oftewel een techniek waarbij westerse topmodellen worden gebruikt om goedkoper eigen modellen te trainen.

Amerikaanse AI-bedrijven schonden zelf op grote schaal intellectuele-eigendomsrechten bij hun zoektocht naar trainingsdata. Bovendien is distillatie een te enge verklaring voor de prijsverschillen. Doordat Chinese labs door exportrestricties afgesneden zijn van de krachtigste AI-chips, moesten hun ingenieurs juist zwaar inzetten op geheugen- en tokenefficiëntie.

Of de Chinese ontwikkelaars de Amerikaanse techgiganten op de lange termijn definitief voorbijstreven, blijft de vraag. Voor zowel Nederlandse als Belgische ondernemingen is de belangrijkste les in elk geval helder: kies geen vast kamp, maar stuur op taakspecifieke prijs-prestatieverhoudingen. Het gecombineerd inzetten van de beste open en gesloten modellen levert niet alleen een kostenbesparing op, maar biedt bedrijven ook de gewenste strategische en juridische onafhankelijkheid.

Lees ook: Digitale soevereiniteit is geen eindbestemming, maar een kompas