Witold Kepinski - 05 oktober 2026

AI-tokens worden goedkoper

Open-weight AI-modellen verwerken voor het eerst de meerderheid van het totale tokenvolume via de AI Gateway van Vercel. In augustus steeg het aandeel van open-weight modellen naar 56 procent van alle verwerkte tokens, een forse toename vergeleken met de 13 procent in april. Tegelijkertijd daalde de gemiddelde prijs per token met 23,2 procent, zo blijkt uit de nieuwste AI Gateway Production Index. De cijfers onderstrepen dat IT-teams en ontwikkelaars hun modelkeuze steeds sterker laten afhangen van een optimale prijs-prestatieverhouding.

AI-tokens worden goedkoper image

Hoewel open-weight modellen in augustus verantwoordelijk waren voor het grootste deel van het verwerkte volume, vertegenwoordigden zij vanwege hun lage kosten slechts 14 procent van de totale financiƫle uitgaven via het platform. De toename van deze voordeligere modellen droeg direct bij aan een verdere daling van de gemiddelde tokenprijs, wat de derde maandelijkse prijsdaling op rij markeert. Ook grote zakelijke gebruikers die maandelijks meer dan 10 miljoen tokens verbruiken, zagen hun kosten per token met een mediaan van 7,6 procent dalen ten opzichte van juli.

De verschuiving naar kostenefficiƫntie is eveneens zichtbaar binnen de portfolio's van grote Closed-weight aanbieders. Bij Anthropic verplaatste het gebruik zich merkbaar van het duurdere Claude Fable 5 naar het goedkopere Opus 5, dat ongeveer de helft kost per token. Door deze interne overstap wist Anthropic zijn marktpositie te behouden en was het in augustus goed voor 64 procent van alle uitgaven via de AI Gateway. Negen op de tien teams die Fable 5 gebruikten, schroefden hun inzet terug en stapten over op voordeligere alternatieven binnen hetzelfde ecosysteem.

Aan de andere kant blijven premium modellen onverminderd populair voor complexe toepassingen waar maximale prestaties vereist zijn. Zo wist OpenAI met het begin september gelanceerde GPT-6 Astra snel terrein te winnen. Ondanks dat Astra twee keer zo duur is per token als GPT-5.6 Sol, was het binnen twee dagen al goed voor een derde van alle uitgaven aan OpenAI-modellen. Samen waren Astra en Sol goed voor 27 procent van het totale verwerkte OpenAI-tokenvolume, maar vertegenwoordigden zij 71 procent van de omzet. Lichte modellen zoals Luna en Nano verwerkten weliswaar ruim twee keer zoveel tokens, maar zorgden voor negen keer lagere uitgaven.

Naast de balans tussen prijs en prestatie winnen sterk gespecialiseerde AI-modellen aan terrein. Jev van TypeSafe AI, een model specifiek ontworpen voor gestructureerde besluitvorming binnen software, werd het snelst geadopteerde model in de geschiedenis van de AI Gateway. Binnen 24 uur na de lancering maakte bijna 13 procent van de betalende teams gebruik van de applicatie. Omdat Jev direct gestructureerde data levert in plaats van vrije tekst, toont de snelle integratie aan dat gerichte nichemodellen een vaste waarde worden in moderne software-architecturen.

Axians - Oktober 2026 - AI MSP Global BW + BN
Axians - Oktober 2026 - AI

Wil jij dagelijkse updates?

Schrijf je dan in voor onze nieuwsbrief!