Tokenprijzen daalden, maar het AI-budget steeg
August 27, 2026
Lagere tokenprijzen zijn niet synoniem met lagere totale AI-uitgaven. Een goedgekeurd budget kan fors worden overschreden na een grote providerkorting omdat het volume, de modelmix, de contextlengte en autonome agentactiviteiten sneller toenamen dan de tarieven daalden. De strategische vraag voor de CFO is niet of AI per token goedkoper werd, maar wat er precies veranderde tussen het goedgekeurde businessplan en de uiteindelijke factuur.
Bouw de variantiebrug over vier assen
Vertrek vanuit de goedgekeurde nulmeting: providerfacturen, geaccordeerde volumeprognoses en de gebudgetteerde modelmix. Verklaar de afwijking in vier stappen: Tarief (Rate) omvat prijsdalingen en staffelkortingen. Volume omvat verzoeken en tokens. Mix omvat verschuivingen tussen modellen, providers en regio's. Efficiëntie omvat de kosten om één succesvol resultaat te leveren, inclusief retries, contextlengte en tool calls.
| Variantie | Financiële betekenis | Verantwoordelijke |
|---|---|---|
| Tarief | Leverancierscondities gewijzigd | Inkoop / Procurement |
| Volume | Vraag overstijgt het plan | Product en Sales |
| Mix | Ander type intelligentie ingezet | Engineering |
| Efficiëntie | Zelfde resultaat kost meer tokens | Engineering en Product |
Beloon niet het verkeerde getal
Een dalende gemiddelde tokenprijs maskeert regelmatig een verslechterende dekkingsbijdrage per klant. Een applicatie trekt mogelijk snel gebruikers aan, terwijl elke voltooide transactie exponentieel meer redeneerstappen en context vergt. Koppel de bestuursrapportage daarom altijd aan tastbare uitkomsten: kosten per geslaagde taak of brutomarge per AI-functie.
Vereisten voor de maandafsluiting
Finance moet een met facturen afgestemd overzicht ontvangen, inclusief de variantiebrug en een prognose op basis van reële gebruiksdrijvers. Eis inzicht in p50- en p95-kosten per geslaagde taak en wijs eigenaren toe aan de drie grootste kostenverschuivingen.