← home

Tokenprijzen daalden, maar het AI-budget steeg

August 27, 2026

By the LLM CFO team

Lagere tokenprijzen zijn niet synoniem met lagere totale AI-uitgaven. Een goedgekeurd budget kan fors worden overschreden na een grote providerkorting omdat het volume, de modelmix, de contextlengte en autonome agentactiviteiten sneller toenamen dan de tarieven daalden. De strategische vraag voor de CFO is niet of AI per token goedkoper werd, maar wat er precies veranderde tussen het goedgekeurde businessplan en de uiteindelijke factuur.

Bouw de variantiebrug over vier assen

Vertrek vanuit de goedgekeurde nulmeting: providerfacturen, geaccordeerde volumeprognoses en de gebudgetteerde modelmix. Verklaar de afwijking in vier stappen: Tarief (Rate) omvat prijsdalingen en staffelkortingen. Volume omvat verzoeken en tokens. Mix omvat verschuivingen tussen modellen, providers en regio's. Efficiëntie omvat de kosten om één succesvol resultaat te leveren, inclusief retries, contextlengte en tool calls.

VariantieFinanciële betekenisVerantwoordelijke
TariefLeverancierscondities gewijzigdInkoop / Procurement
VolumeVraag overstijgt het planProduct en Sales
MixAnder type intelligentie ingezetEngineering
EfficiëntieZelfde resultaat kost meer tokensEngineering en Product

Beloon niet het verkeerde getal

Een dalende gemiddelde tokenprijs maskeert regelmatig een verslechterende dekkingsbijdrage per klant. Een applicatie trekt mogelijk snel gebruikers aan, terwijl elke voltooide transactie exponentieel meer redeneerstappen en context vergt. Koppel de bestuursrapportage daarom altijd aan tastbare uitkomsten: kosten per geslaagde taak of brutomarge per AI-functie.

Vereisten voor de maandafsluiting

Finance moet een met facturen afgestemd overzicht ontvangen, inclusief de variantiebrug en een prognose op basis van reële gebruiksdrijvers. Eis inzicht in p50- en p95-kosten per geslaagde taak en wijs eigenaren toe aan de drie grootste kostenverschuivingen.

Related

← Back to llmcfo.com