Naar de inhoud
NLEN
Illustratie: Prijskaart: wat een miljoen tokens nu kost (doorlopende tracker)

Door Ivo Donker — samengesteld met AI-ondersteuning · Laatst bijgewerkt: 8 augustus 2026

Prijskaart: wat een miljoen tokens nu kost (doorlopende tracker)

Dit is radars eerste bijwerkbare pagina in plaats van een momentopname. Waar de maandartikelen een stand van één periode vastleggen, wordt deze prijskaart telkens bijgewerkt als er prijzen veranderen. Het vertrekpunt is het artikel over de prijzenoorlog van juli: daarin stond hoe OpenAI, DeepSeek en anderen hun tarieven verlaagden. Deze tracker houdt de vervolgstand bij, met per getal een bron en een datum, en wordt maandelijks ververst. De eerste versie staat op 8 augustus 2026.

Zo lees je deze pagina: alle prijzen zijn per 1 miljoen tokens, in Amerikaanse dollars, en gelden voor API-gebruik via de officiële provider tenzij anders vermeld. Prijzen verschillen per contextlengte, per reseller en per cache-instelling; de tabel geeft de standaardtarieven voor reguliere context. Bij elke rij staat een bron en de datum waarop die bron is gecontroleerd. Wie zelf rekent, kan de kosten per taak benaderen zoals op benchmark.llmnet.nl bij kosten per taak wordt uitgelegd — prijs per token is niet hetzelfde als prijs per taak, omdat modellen verschillen in het aantal tokens dat ze nodig hebben om een taak af te maken.

De stand van 8 augustus 2026

ModelInput ($/1M)Output ($/1M)Bron (gecontroleerd op)
DeepSeek V4 Flash$0,14$0,28deepseek.ai/pricing (25-07-2026)
DeepSeek V4 Pro$0,435$0,87deepseek.ai/pricing (25-07-2026)
GPT-5.2$0,875$7,00pricepertoken.com (07-08-2026)
GPT-5.2 Pro$10,50$84,00pricepertoken.com (07-08-2026)
Claude Opus 5$5,00$25,00benchlm.ai/anthropic (07-08-2026)
Claude Sonnet 5$2,00$10,00benchlm.ai/anthropic (07-08-2026; introductietarief t/m 31-08)
Claude Haiku 4.5$1,00$5,00benchlm.ai/anthropic (07-08-2026)
Gemini 3 Flash$0,15$0,60llmwise.ai (aug-2026)

De spreiding tussen de goedkoopste en de duurste rij is groot: een miljoen outputtokens kost bij DeepSeek V4 Flash $0,28 en bij GPT-5.2 Pro $84 — een factor driehonderd. Daartussen zit de keuze die de meeste bouwers maken: een flagship-model voor moeilijke taken en een goedkoop model voor de bulk. De afweging tussen kwaliteit, kosten en snelheid bij die keuze wordt op benchmark.llmnet.nl bij kwaliteit versus kosten in detail behandeld; deze tracker levert de prijslaag die die afweging nodig heeft.

Wat er sinds de juli-editie is veranderd

Het juli-artikel noteerde de prijsverlagingen van DeepSeek en de nieuwe lage tarieven van OpenAI. Drie bewegingen zijn sindsdien zichtbaar in de bronnen die deze tracker volgt:

  • DeepSeek V4 Pro werd permanent goedkoper. Op 31 mei 2026 waren de standaardtarieven al verlaagd van $1,74/$3,48 naar $0,435/$0,87 per miljoen input/outputtokens — een verlaging van ongeveer 75 procent. De bronnen die deze tracker in augustus controleerde, bevestigen dat dit de geldende tarieven zijn en geen promotionele korting.
  • GPT-5.2 zakte in drie maanden. De goedkoopste inputprijs van GPT-5.2 is volgens pricepertoken in negentig dagen met de helft gedaald, van $1,75 naar $0,875 per miljoen inputtokens; de outputprijs staat op $7,00. Dat is een andere beweging dan bij DeepSeek: geen eenmalige verlaging, maar een geleidelijke afbouw terwijl nieuwere modellen uitkomen.
  • Claude houdt zijn tariefkaart vast. Opus 5 staat op $5/$25, hetzelfde niveau als Opus 4.7 en 4.8. Sonnet 5 loopt met een introductietarief van $2/$10 tot en met 31 augustus 2026, waarna het standaardtariëf van $3/$15 ingaat. Haiku 4.5 blijft op $1/$5.

Voor wie deze verschuivingen in de praktijk wil benutten, is routing de sleutel: het automatisch sturen van eenvoudige verzoeken naar het goedkope model en alleen moeilijke taken naar het dure model. Hoe je dat opzet — inclusief fallback en kostenbewaking — staat op api.llmnet.nl bij model-routing. De technieken om het tokenverbruik zelf te beperken, zoals promptcaching en kortere contexten, staan in het juli-artikel over tokenbesparing.

Waarom prijzen per miljoen tokens misleidend kunnen zijn

De tabel hierboven is een handig beginpunt, maar drie kanttekeningen zijn nodig voordat je er een budget op baseert.

Ten eerste tellen outputtokens zwaarder dan inputtokens, en sommige modellen genereren meer outputtokens voor dezelfde taak. Een model dat $0,14 per miljoen inputtokens kost maar drie keer zoveel outputtokens produceert als een duurder model, kan per taak duurder uitvallen. De methode om dat te meten — een vaste testset, dezelfde taak, en de kosten per taak in plaats van per token — staat op benchmark.llmnet.nl bij kosten per taak.

Ten tweede rekenen veel aanbieders meer voor lange contexten. De tarieven in de tabel gelden voor reguliere context; wie structureel veel tokens in de prompt stopt, moet de specifieke prijspagina van de aanbieder controleren. Een architectuur die de context klein houdt — bijvoorbeeld door retrieval in plaats van alles in de prompt te zetten — verandert de kosten meer dan een paar cent op de tabel. Het patroon voor hybride opstellingen, waarin je verzoeken verdeelt over lokale en cloud-endpoints, staat op api.llmnet.nl bij hybrid cloud/edge-integraties — gepubliceerd op 7 augustus en daarmee een van de actueelste pagina's in het netwerk.

Ten derde zijn cachetarieven een eigen categorie. DeepSeek rekent voor cache-hits $0,0028 per miljoen inputtokens bij V4 Flash — vijftig keer goedkoper dan de gewone inputprijs. Wie herhaalde context (systeemprompts, vaste documenten) slim cachet, kan de effectieve prijs fors verlagen. De cachetarieven staan op dezelfde bronnen als de tabel; ze zijn bewust niet in de hoofdkolommen gezet omdat ze per provider sterk verschillen in voorwaarden.

Wat deze tracker niet doet

Deze pagina is geen koopadvies en geen volledige prijsdatabase. Hij volgt de modellen die in radars maandartikelen het vaakst terugkomen en die voor de doelgroep van dit netwerk — de bouwer die zelf met LLM's werkt — het meest relevant zijn. Modellen van kleinere aanbieders, speciale batchtarieven en resellerprijzen komen niet in elke update voor. Wie een uitputtende vergelijking wil, kan de geciteerde bronnen zelf raadplegen; de links in de tabel zijn bewust extern zodat de controle altijd mogelijk blijft.

De updates volgen het ritme van de maandartikelen: bij elke nieuwe maand-editie wordt deze pagina opnieuw gecontroleerd en krijgt hij een nieuwe stand-van-datum. Tussentijdse grote prijswijzigingen — zoals de DeepSeek-verlaging in mei — worden direct verwerkt, omdat een prijstracker die drie weken achterloopt meer kwaad dan goed doet.

Signaal: hoog · Actie: herberekenen.

De prijsverschillen tussen modellen zijn sinds juli groter geworden, niet kleiner. Voor bestaande toepassingen is een herberekening van de kosten per taak met de huidige tarieven daarom zinvol — zeker als je een vast model draait dat sinds mei niet is heroverwogen. Begin met de goedkoopste rij die de taalkwaliteit haalt, en gebruik routing om de rest op te vangen. De bouwstenen daarvoor staan op api.llmnet.nl bij het zelf hosten van een LLM-gateway — daar staat ook hoe je logging en kostenbewaking meeneemt, zodat de volgende prijsverlaging niet aan je voorbijgaat.

Verantwoording en bronnen

De prijzen in de tabel zijn op 8 augustus 2026 gecontroleerd tegen de genoemde bronnen. Voor DeepSeek is de officiële prijspagina (deepseek.ai/pricing) gebruikt, onafhankelijk geverifieerd op 25 juli 2026; voor OpenAI en Anthropic zijn de prijsaggregatoren pricepertoken.com en benchlm.ai gebruikt, beide geüpdatet op 7 augustus 2026; voor Gemini is llmwise.ai gebruikt. Waar bronnen onderling verschilden, is de meest recente controle gekozen en is het verschil niet weggemoffeld — in de kanttekeningen hierboven staat waar context- en cachetarieven afwijken. De modellenrijen zelf komen uit de radarpijler markt: het modelnieuws van juli en de stand van open-weight modellen geven de context bij de releases die deze prijzen verklaren.