Claude Code /claude-api cost-optimize: grip op je AI-kosten
In het kort
- Wat: Claude Code (versie 2.1.247) heeft een nieuwe ingebouwde skill:
/claude-api cost-optimize. Die bekijkt wat een bestaand project aan Claude API-verbruik kost en loopt vijf kostenknoppen langs — caching, token-hygiëne, batchverwerking, effort-niveau en modelkeuze. - Waarom relevant: AI-kosten lopen bij het MKB vaak stilletjes op. Deze skill maakt zichtbaar wáár het geld heen gaat en waar besparing zit, zonder dat je zelf spreadsheets hoeft te bouwen.
- Wat je ermee kunt: In je bestaande Claude-opstelling laten uitrekenen waar je overbetaalt, en concrete knoppen omzetten — vaak zonder dat je toepassing er trager of slechter van wordt.
Wat is er precies nieuw?
Anthropic heeft aan Claude Code een skill toegevoegd met de naam /claude-api cost-optimize. In de release-notes staat het zo omschreven: de skill "profileert het Claude API-verbruik van een bestaand project en werkt de kostenknoppen af (caching, token-hygiëne, batch, effort, modelkeuze)".
Even de begrippen ontrafeld. Claude Code is de opdrachtregel-tool waarmee ontwikkelaars Claude in hun eigen projecten inzetten. De API is de manier waarop je software rechtstreeks met Claude praat — en waar je per verbruik voor betaalt. Een skill is een kant-en-klaar recept dat Claude Code voor je uitvoert. Deze skill rekent dus niet zomaar wat, maar loopt een vast lijstje besparingsmogelijkheden af en laat zien wat elke keuze scheelt.
Dat is nieuw omdat je voorheen die analyse handmatig deed of extern liet bouwen. Nu zit het in de tool zelf.
De vijf kostenknoppen, in gewone taal
De skill kijkt naar vijf plekken waar geld weglekt. Kort wat ze betekenen:
- Caching (prompt-caching): Stuur je telkens dezelfde grote lap tekst mee — een handleiding, productcatalogus of huisstijl-instructie — dan hoeft Claude die niet elke keer opnieuw te verwerken. Anthropic rekent voor zulke hergebruikte stukken fors minder: het teruglezen uit de cache is een stuk goedkoper dan de eerste keer. Bij herhalend werk telt dat snel op.
- Token-hygiëne: Een token is een stukje tekst waarop je betaalt. Sleep je onnodig veel context mee — oude gesprekken, hele documenten waar je maar één alinea van nodig hebt — dan betaal je voor lucht. Opschonen scheelt direct.
- Batchverwerking (Batch API): Werk dat niet meteen af hoeft (denk aan 's nachts duizend producten voorzien van een omschrijving) kun je in een batch aanbieden. Anthropic geeft daar een vaste korting op ten opzichte van directe verzoeken.
- Effort-niveau: Sommige taken vragen diep 'nadenken', andere zijn simpel. Voor eenvoudig werk een lager denk-niveau kiezen bespaart tokens, zonder merkbaar kwaliteitsverlies.
- Modelkeuze: Niet elke klus heeft het zwaarste model nodig. Een lichter, goedkoper Claude-model (zoals Haiku) doet routinewerk prima; het krachtigere model reserveer je voor het lastige werk.
Het slimme zit hem in de combinatie: de skill meet per knop wat het oplevert, zodat je keuzes maakt op cijfers in plaats van op gevoel.
Wat betekent dit concreet voor het Nederlandse MKB?
Veel MKB-bedrijven zijn AI aan het uitproberen: een klantenservice-assistent, product-teksten, een interne zoekhulp door eigen documenten (RAG). Zulke toepassingen werken vaak prima in een test, maar de kosten worden pas voelbaar als het volume groeit. Dan komt de vraag: betalen we hier niet te veel voor?
Deze skill geeft daar antwoord op zonder gokwerk. In plaats van 'AI is duur' krijg je 'op dít onderdeel gaat 40% van je verbruik, en met caching valt daar de helft van weg'. Dat is het verschil tussen een onderbuikgevoel en een onderbouwde beslissing.
Een paar herkenbare situaties:
- Stuur je bij elke klantvraag je hele productcatalogus mee? Caching en token-hygiëne zijn dan waarschijnlijk je grootste winst.
- Draai je grote, niet-urgente verwerkingen (nieuwsbrieven, bulk-teksten)? Batchverwerking levert een vaste korting.
- Laat je alles door het zwaarste model doen? Een deel kan vaak naar een lichter model.
Belangrijk: dit is een tool voor wie al met de Claude API werkt of dat door een ontwikkelaar laat doen. Heb je geen technisch iemand in huis, dan is dit precies zo'n analyse die je laat uitvoeren — je krijgt er een helder besparingsplan uit terug.
Wil je dit door iemand met ervaring laten oppakken? vind een Claude-specialist die je opstelling doorlicht en de knoppen voor je omzet.
Hoe past dit in de rest van Claude Code?
Deze skill staat niet op zichzelf. Claude Code kreeg eerder al betere kosten-inzichten, zoals een uitsplitsing van je verbruik per taak — daarover schreven we in Claude Code /usage krijgt 'Loops'-uitsplitsing per taak. Waar /usage laat zien waar je verbruik zit, helpt cost-optimize je vervolgens om er iets aan te doen.
In dezelfde release breidde Anthropic ook de bredere /claude-api-skill uit met meer beheer-functies (organisatieleden, workspaces, rapportages over je limieten). En een eerdere versie voegde instellingen toe om prompt-caching langer vast te houden — tot een uur voor hoofdgesprekken. Samen wijst dat op één richting: meer controle en overzicht over wat je AI-gebruik kost.
Voor een ondernemer is dat geruststellend. AI-kosten hoeven geen zwarte doos te zijn. Met de juiste analyse weet je waar je aan toe bent, en kun je opschalen met vertrouwen in plaats van met koudwatervrees.
Aan de slag?
Benieuwd of jouw Claude-toepassing goedkoper kan zonder in te leveren op kwaliteit? Wij zijn een Nederlandse community van Claude-specialisten (niet gelieerd aan Anthropic) en denken graag met je mee.
Plan gerust een gratis kennismaking via [email protected] — dan kijken we samen waar jouw besparing zit.
← Alle artikelen