Waarom “AI-credits” geen eenduidig product is
Wie AI-modellen via een API wil gebruiken, loopt al snel tegen een woud aan prijsmodellen aan. De ene partij verkoopt puur modeltoegang. De andere bundelt dat met cloud-infrastructuur. Weer een ander focust op zo snel en goedkoop mogelijke inference voor open-source modellen. “Credits kopen” betekent dus bij elke partij iets anders — en dat maakt kosten vergelijken lastiger dan het op het eerste gezicht lijkt.
Dit artikel zet de drie meest uiteenlopende types naast elkaar: OpenRouter, DigitalOcean en Together AI. Daarna volgt een rijtje directe concurrenten die je op z’n minst moet kennen.
De drie providers op een rij
OpenRouter — de aggregator
OpenRouter is geen eigen inference-provider. Het is een marktplaats: één API, één credit-balans, voor honderden modellen die onder de motorkap bij totaal verschillende providers draaien. Het grote voordeel? Flexibiliteit. Model wisselen is een parameter aanpassen, geen nieuwe integratie bouwen — en valt een provider uit, dan schakelt OpenRouter automatisch over.
Het verdienmodel zit ’m niet in een opslag per token, maar in een fee op het opwaarderen van je creditsaldo: 5,5%, met een minimum van $0,80. De tokenprijzen zelf liggen vrijwel gelijk aan wat je bij de onderliggende provider rechtstreeks zou betalen.
DigitalOcean — het cloudplatform met AI erbij
DigitalOcean is in de kern een cloudhostingpartij — droplets, databases, Kubernetes — die met het Gradient AI Platform er ook modeltoegang en agent-hosting bij is gaan aanbieden. De tokenprijs is niet het laagste van het stel, en dat hoeft ook niet: het voordeel zit ’m erin dat je AI-gebruik in dezelfde factuur en hetzelfde account landt als infrastructuur die je toch al draait. Nieuwe accounts krijgen meestal ook nog eens $200 aan gratis krediet, inzetbaar over alle DigitalOcean-producten.
Together AI — de directe inference-specialist
Together AI host de modellen zelf — vooral open-source — en richt zich op schaalbare, betaalbare inference. Geen marktplaats, geen cloud-bijzaken: puur API-toegang met eenvoudige pay-as-you-go tokenprijzen. Draai je specifiek open modellen als Llama en heb je de aggregator-flexibiliteit van OpenRouter niet nodig, dan is dit meestal je voorspelbaarste optie.
Kostenvergelijking: hetzelfde model, drie prijzen
Om providers eerlijk te vergelijken helpt het om naar hetzelfde model te kijken. Hieronder de prijs per miljoen tokens voor Llama 3.1 70B (of het dichtstbijzijnde vergelijkbare aanbod) bij elke provider.
Wat meteen opvalt: OpenRouter is op dit model het goedkoopst. Logisch — als aggregator routeert het gewoon naar de goedkoopste beschikbare provider, zonder eigen marge op de tokenprijs. DigitalOcean’s outputprijs springt er daarentegen behoorlijk uit. Dat zegt meer over de aard van het platform — breed, all-in-one, niet ingericht op de laagste tokenprijs — dan dat het een slechte keuze zou zijn. De afweging ligt hier gewoon ergens anders.
Nog meer opties
OpenRouter, DigitalOcean en Together AI zijn niet de enige spelers. Het aanbod van inference-providers is de afgelopen tijd flink gegroeid — hier zijn drie die qua prijs en positionering het vergelijken waard zijn:
| Provider | Prijs per miljoen tokens (in / uit) | Waar het om draait |
|---|---|---|
| DeepInfra | $0,40 / $0,40 | Vaak de laagste prijs per token van de directe providers |
| Groq | $0,59 / $0,79 (Llama 3.3 70B — Llama 3.1 70B is daar inmiddels vervangen) | Extreem lage latency door eigen LPU-hardware, gratis dagelijks quotum zonder creditcard |
| Fireworks AI | $0,90 / $0,90 | Vergelijkbaar met Together AI, ook fine-tuning van modellen |
Daarnaast kom je namen tegen als Replicate (eigen, afwijkend API-formaat), Novita AI, Hyperbolic, Cerebras (ook met gratis quotum) en Hugging Face Inference Providers (een marktplaats-model, vergelijkbaar met OpenRouter). Voor die laatste groep zijn de tarieven te wisselend en model-afhankelijk om hier zonder verificatie een hard getal aan te plakken — check de eigen pricing-pagina voordat je kiest.
Welke past bij jouw situatie
- Je wilt snel wisselen tussen modellen, of experimenteren zonder ergens aan vast te zitten: OpenRouter. Eén integratie, honderden modellen, betaal het onderliggende tarief plus een kleine fee op je saldo.
- Je draait al infrastructuur bij dezelfde partij (servers, databases) en wilt AI in dezelfde factuur en hetzelfde dashboard: DigitalOcean. De tokenprijs is niet het laagste, maar de integratie met de rest van je stack weegt vaak zwaarder dan een paar cent per miljoen tokens.
- Je weet precies welk open-source model je nodig hebt en wilt voorspelbare, schaalbare inference zonder marktplaats-laag ertussen: Together AI.
Voor de meeste kleinere projecten en experimenten is OpenRouter’s aggregator-aanpak gewoon het pragmatischt: lage instapdrempel, geen keuzestress vooraf, en achteraf zonder gedoe een ander model proberen.
Een kanttekening
Prijzen in de AI-API-markt veranderen snel, soms wekelijks. Zie de cijfers hierboven als een momentopname van augustus 2026, geen permanente waarheid. Ga je op basis hiervan echt een keuze maken? Check dan eerst de actuele pricing-pagina van de provider zelf.

