In het kort: voor agentic coding koop je tokens het voordeligst via een abonnement rechtstreeks bij de modelmaker: Anthropic voor Claude Code, OpenAI voor Codex. Daarin zit veel meer gebruik dan dezelfde euro's tegen API-tarief opleveren. GitHub Copilot rekent sinds 1 juni 2026 per token tegen de API-prijs van het model. Mijn augustus: ruim 20 miljard Opus 5-tokens, omgerekend ruim 13.000 USD bij Copilot, bij Anthropic één maand abonnement van 180 EUR.
Voor wie? IT-managers en tech leads die het AI-budget van een .NET-team beheren. En developers die steeds zonder tokens zitten.
Prijzen, plannen en limieten in dit artikel zijn de stand van eind september 2026; check de actuele voorwaarden bij GitHub, Anthropic en OpenAI.
"Eén developer maakte in één middag alle tokens van het hele team op." En van een andere IT-manager: "Ik stort telkens wat budget bij. Toch maken ze soms in een uur zo 100 euro op."
Dat hoor ik van IT-managers die ik spreek. Bij andere managers hoor ik die klacht niet. Het verschil zit zelden in de developers. De vraag eronder: waar koop je tokens voor agentic coding het voordeligst in en waarom scheelt dat zoveel?
Waarom zijn de tokens van je developers zo snel op?
Agentic coding verbruikt tokens in een ander tempo dan een eenvoudig chatvenster. Een agent stuurt bij elke stap de hele context opnieuw mee: de systeemprompt, je instructiebestanden in de repo, de tooldefinities en het complete gesprek tot dan toe, inclusief alle toolresultaten. Een sessie van honderd stappen leest die context dus honderd keer. Bij mij was in augustus 97,8 procent van alle tokens zo'n herlezing, een cache-read.
Een teambudget dat als potje credits tegen API-tarief is ingericht, loopt daardoor leeg bij de eerste developer die agents serieus inzet. Daar is niets mis mee, zo werkt de meter. Wie alleen code-aanvullingen en af en toe een chatvraag gebruikt, merkt er niets van. Wie een ochtend lang agents parallel laat werken, is nog voor de lunch door een maandbudget heen.
Wat gebeurde er in augustus bij mij?
In augustus liep ik tegen de weeklimiet van Claude Code aan, op een Max 20x-abonnement. Dus wilde ik GitHub Copilot proberen. Op 11 augustus kocht ik Copilot Pro+ en dezelfde dag nog een upgrade naar Copilot Max: 100 USD per maand, 200 USD aan AI credits erin. Het was binnen de kortste keren op.
Daarna Codex Pro 20x, 200 USD per maand. Daar kon ik heel veel meer mee, met hetzelfde werk en dezelfde manier van werken. Dat verschil wilde ik snappen. Het bleek niet in de tools te zitten.
Hoe rekent GitHub Copilot sinds 1 juni af?
De plannen en tarieven in deze sectie zijn de stand van eind september 2026, zoals GitHub ze zelf publiceert.
Sinds 1 juni 2026 rekent Copilot chat- en agentgebruik per token af, tegen de gepubliceerde API-prijs van het gekozen model[1]. De oude premium requests zijn vervangen door AI credits, waarbij 1 credit gelijkstaat aan 0,01 USD. Code-aanvullingen en next-edit-suggesties blijven buiten de meter. In juni rekende ik al voor wat dat betekent voor 47 miljoen tokens in een maand; augustus liet zien hoe hard het doorloopt.
Elk plan geeft een maandelijks tegoed dat aan het eind van de maand vervalt[2]. Opvallend: individuele plannen krijgen anderhalf tot twee keer hun prijs aan credits, zakelijke seats precies hun prijs.
| Copilot-plan | Prijs per maand | Inbegrepen credits | Waarde tegen API-tarief |
|---|---|---|---|
| Pro | 10 USD | 1.500 | 15 USD |
| Pro+ | 39 USD | 7.000 | 70 USD |
| Max | 100 USD | 20.000 | 200 USD |
| Business | 19 USD per seat | 1.900 | 19 USD |
| Enterprise | 39 USD per seat | 3.900 | 39 USD |
Is het tegoed op, dan betaal je bij tegen diezelfde API-prijs. Voor Claude Opus 5 rekent GitHub 5 USD per miljoen input-tokens, 25 USD per miljoen output-tokens, 6,25 USD per miljoen cache-writes en 0,50 USD per miljoen cache-reads[3]. Dat is exact het lijsttarief van Anthropic. GitHub moet die tokens immers zelf inkopen bij de modelmaker.
Wat krijg je bij de modelmaker zelf?
Bij Anthropic en OpenAI koop je een gebruiksrecht met limieten, geen potje credits dat wegtikt. Claude Code zit in de Pro- en Max-plannen van Anthropic; Max 20x kost 200 USD per maand, ik betaal 180 EUR. Kom je boven je limiet, dan kun je bijkopen tegen het standaard API-tarief[4], maar tot die limiet tikt er geen meter mee. Bij OpenAI zit Codex in de ChatGPT-plannen, met sinds 9 april een Pro 5x van 100 USD en een Pro 20x van 200 USD[5].
Daar zit het verschil. Binnen zo'n abonnement krijg je veel meer tokens voor je geld dan wanneer je diezelfde tokens tegen API-prijs moet afrekenen. Hoeveel meer, dat wilde ik precies weten.
Hoeveel scheelt het? Mijn augustus in cijfers
Claude Code bewaart per sessie een logbestand met de tokenaantallen van elk bericht. Die heb ik voor augustus opgeteld, ontdubbeld per bericht, alleen voor Opus 5 en alleen van deze pc. Daarna heb ik ze geprijsd tegen GitHub's eigen Opus 5-tarief in Copilot. Geen factuur dus, een omrekening: dit is wat dezelfde tokens bij Copilot hadden gekost.
| Augustus 2026, Opus 5 | Tokens | Copilot-tarief per miljoen | Kosten |
|---|---|---|---|
| Input | 297.704 | 5,00 USD | 1 USD |
| Output | 44,6 miljoen | 25,00 USD | 1.115 USD |
| Cache-writes | 391 miljoen | 6,25 USD | 2.446 USD |
| Cache-reads | 19,7 miljard | 0,50 USD | 9.854 USD |
| Totaal | 20,14 miljard | 13.417 USD |
Trek daar de 200 USD credits van Copilot Max vanaf en je houdt ruim 13.000 USD bijbetalen over, voor één maand van één developer. Bij Anthropic was het één maand van mijn abonnement van 180 EUR. De laatste dertig dagen voor dit artikel lagen lager, 10,5 miljard tokens, omgerekend 7.200 USD; het beeld verandert niet.
Ruim 13.000 USD tegen API-tarief. 180 EUR via het abonnement. Dezelfde tokens.
Waarom zijn het bijna allemaal cache-reads?
Dat hoge aandeel cache-reads is geen slordigheid, het is hoe agentic coding werkt. Prompt caching zorgt dat het ongewijzigde deel van de context tegen een tiende van de inputprijs wordt gelezen. Zonder die cache hadden diezelfde 19,7 miljard tokens tegen 5 USD per miljoen bijna 100.000 USD gekost. De cache doet dus precies wat hij moet doen.
Wat wel een keuze is, is hoeveel context elke stap opnieuw leest. Bij mij was dat ongeveer 440 tokens gelezen per token geschreven. Wie meerdere sessies parallel draait, vermenigvuldigt dat nog eens.
Dat getal druk je omlaag met kortere sessies, met subagents voor verkennend werk zodat alleen de conclusie in de hoofdcontext komt, met minder standaard geladen tooldefinities, met een compacte CLAUDE.md en met af en toe een /compact, dat de sessiegeschiedenis samenvat. Op een abonnement levert dat weeklimiet op, bij Copilot scheelt het direct geld.
Wat betekent dit voor een team?
Begin je met agentic coding, neem dan een teamabonnement rechtstreeks bij de modelmaker en liever niet via een tussenpartij. Anthropic Team heeft een Standard seat van 20 tot 25 USD en een Premium seat van 100 tot 125 USD met vijf keer het gebruik van Standard, met Claude Code erin; extra gebruik gaat tegen API-tarief[6]. OpenAI Business kost 20 USD per gebruiker met inbegrepen gebruik en bij te kopen credits[5]. Zet daar Copilot Business naast: 19 USD aan credits in een seat van 19 USD.
Kijk bij die plannen vooral naar twee getallen: hoeveel gebruik zit erin en wat betaal je daarboven. Voor een team spelen ook inkoop en beheer mee, en leunen op één provider is een afweging op zich. Eerlijk is eerlijk: ik heb dit gemeten voor mijn eigen praktijk, niet voor een team van twintig. Maar de meter werkt bij een team hetzelfde als bij mij.
Blijft dit zo?
Daar zou ik niet zomaar van uitgaan. OpenAI zette op 10 september de verkoop van het Pro 20x-plan tijdelijk stil voor nieuwe klanten, omdat de vraag naar het nieuwe Astra-model te groot was[7]. Op 14 september verviel bij Anthropic de tijdelijke zomerverhoging van de Claude Code-weeklimiet: 17 procent minder dan in de zomer, al is het nog 25 procent meer dan in mei[8].
Die ruime abonnementen zijn er, denk ik, vooral om grootverbruikers te binden. Dat staat mooi op weg naar de beursgangen van Anthropic en OpenAI, die allebei in juni hun aanvraag indienden[9].
Of ze zoveel meer tokens per euro op langere termijn blijven aanbieden, weet ik niet. Reken er in elk geval op dat je model of abonnement morgen anders kan zijn. Profiteer ervan zolang het kan, zou ik zeggen.
Waar het op neerkomt: waar je inkoopt bepaalt hoeveel agentic werk je voor hetzelfde geld krijgt. Dat verschil loopt in ordes van grootte. Wil je weten hoe dat bij jullie ligt, tel dan één maand tokens van de developer die het meest met agents werkt en reken ze door tegen de API-prijs van het model. Dat ene getal zegt meer dan elke prijspagina.
Waar kopen jullie je tokens in? En hoe vaak zitten jullie zonder?
Bronnen
- GitHub Blog, 27 april 2026, "GitHub Copilot is moving to usage-based billing": verbruik berekend "using the listed API rates for each model", ingangsdatum 1 juni 2026 ↩
- GitHub Docs, Plans for GitHub Copilot: inbegrepen AI credits per plan; credits vervallen maandelijks ↩
- GitHub Docs, Models and pricing for GitHub Copilot: tarieven per miljoen tokens, waaronder Claude Opus 5 ↩
- Claude Help Center, Using Claude Code with your Pro or Max plan: extra gebruik "billed at standard API rates" ↩
- OpenAI, ChatGPT pricing (Codex): Pro vanaf 100 USD met 5x of 20x de limieten van Plus, Business 20 USD per gebruiker, credits bij te kopen ↩
- Anthropic, Claude pricing: Team Standard en Premium seats, Enterprise "seat price + usage at API rates" ↩
- TechCrunch, 10 september 2026, "OpenAI puts Pro subscriptions on hold due to Astra demand" ↩
- BleepingComputer, 29 augustus 2026, "Anthropic is cutting Claude Code's current weekly limits by 17%": tijdelijke +50% vervangen door permanente +25% per 14 september ↩
- CNBC, 8 juni 2026, "OpenAI confidentially files for IPO"; Bloomberg, 26 juni 2026, "OpenAI Considers 2027 IPO After Anthropic's Expected Public Debut" ↩