Het korte antwoord
De goedkoopst geprijsde rij in de Whizi kostenindex is Ling van inclusionAI, met $0.000053 om één keer te antwoorden. Deze rekent één credit per bericht, net als elke andere rij onderaan de ladder, en de ondergrens per beurt garandeert dat niets ooit minder dan één credit kost.
Eén goedkope rij per abonnement, als opstap naar de volledige tabellen hieronder:
| Model | Aanbieder | Kosten per antwoord | Context | Credits | Abonnement |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Een standaardantwoord in de index is 1,000 inputtokens plus 500 outputtokens, zodat lijstprijzen van verschillende aanbieders vergelijkbaar worden. De brondata zijn op 2026-08-20 opgehaald bij OpenRouter. De index prijst 100 rijen bij 29 aanbieders, en 89 daarvan dragen een Whizi creditkosten. De volledige dataset is gepubliceerd als de AI-modelkostenindex.
Deze pagina is het goedkope uiteinde van die index. Voor de catalogus per abonnement, zie de modellijst, en voor de creditladder zelf, zie de creditreferentie.
Rijen onder een tiende cent per antwoord
Een selectie van de rijen die voor minder dan $0.001 per standaardantwoord één keer antwoorden. Op één na rekenen alle hier getoonde rijen een enkele credit.
| Model | Aanbieder | Kosten per antwoord | Context | Credits | Abonnement |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Verschillende van de goedkoopste rijen hebben een miljoen tokens of meer, en het grootste venster in de hele prijsindex hoort bij een rij dicht bij de onderkant van de kostenlijst. Goedkoop en klein zijn hier niet dezelfde as. Het kleinste venster hierboven is 16K.
De meeste van deze rijen staan op het duurste abonnement, om de reden die hieronder wordt uitgelegd.
De volgende band, tot aan de mediaan van de index
De mediaan geprijsde rij is een Kimi reasoning-rij van $0.00185 per standaardantwoord. Een greep uit de rijen tussen een tiende cent en die mediaan:
| Model | Aanbieder | Kosten per antwoord | Context | Credits | Abonnement |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
De creditkolom en de dollarkolom dekken niet dezelfde reeks rijen. Elf van de 100 geprijsde rijen dragen helemaal geen creditkosten: ze zijn geprijsd ter vergelijking, maar worden niet als eigen gemeten rij in het product aangeboden. Een dollarbedrag in de index betekent op zichzelf dus niet dat de rij in de kiezer kan worden geopend.
Waarom de meeste goedkoopste rijen op Powerhouse staan
De abonnementskolom hierboven is geen prijsbeslissing, het is een terugvaloptie. Modeltoegang wordt bepaald op basis van identifier: eerst de vier Starter-identifiers, dan de agentpersona's, dan een expliciete lijst van 37 verdere identifiers voor Pro, en al het overige valt terug op Powerhouse. Een goedkope rij die nooit door iemand naar de Pro-lijst is gepromoveerd, staat daardoor standaard op het topabonnement, wat verklaart waarom de onderkant van de kostenlijst als een Powerhouse-kolom oogt. De terugvaloptie zelf staat gedocumenteerd op de modellijst.
| Abonnement | Wat het bereikt aan het goedkope uiteinde |
|---|---|
| Free | Geen creditbudget. Alleen Whizi AI en Auto, 7 berichten op dag één en daarna 3 per dag |
| Starter | Vier identifiers in totaal: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Ze kosten allemaal 1 credit |
| Pro | Starter plus 37 meer, inclusief de DeepSeek-, Llama-, Gemini Flash-, Mistral- en Qwen-rijen die hierboven als Pro zijn gemarkeerd |
| Powerhouse | Al het overige in de catalogus, waar de rijen van de kleinere labs helemaal onderaan de kostenlijst zich bevinden |
De gratis laag zit helemaal niet in deze vergelijking: sinds 2026-09-02 bereikt die alleen Whizi AI en Auto en verder niets, dus noch de goedkoopste rij in de index, noch de duurste, is erop bereikbaar. Wat het oplevert is 7 berichten op de eerste dag, daarna 3 per dag, besteed aan die twee rijen.
Starter is de smalle. Die bereikt vier identifiers, elk daarvan rekent één credit, en het budget van 400 credits staat dus gelijk aan 400 berichten. Er is geen Anthropic-model op Starter, en geen toegang tot de goedkope rijen van kleinere labs uit de tabellen hierboven.
Wat één credit koopt
Een credit wordt gedefinieerd als één bericht op het huismodel, dat draait op het basis-OpenAI-model dat vastgezet is op één credit. Een buildtest faalt als een van beide ooit die sport verlaat, omdat het verplaatsen van een van beide de hele ladder herdenomineert.
De kosten zijn een vast geheel getal per model-id. Aan dit uiteinde van de catalogus betekent dat: een rij van 1 credit kost één credit, ongeacht de lengte van invoer of uitvoer: plak er een lang document in, laat het antwoord lang doorlopen, en de beurt wordt nog steeds één keer gerekend.
| Rij | Kosten per antwoord | Kosten per 1,000 antwoorden | Credits |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Omgezet naar een budget is de onderste sport de ene plek waar het creditcijfer en het berichtencijfer hetzelfde getal zijn: elke beurt kost één, dus een abonnementsbudget van N credits is N berichten zolang je op rijen van 1 credit blijft. Het budget per abonnement, de reset en de doorrolregel staan allemaal in de creditreferentie.
Nog een mechanisme dat aan het goedkope uiteinde meespeelt: een beurt die niet past binnen het resterende saldo wordt in zijn geheel geweigerd in plaats van gedeeltelijk in rekening gebracht. Twintig credits bij drie resterende credits wordt afgewezen, niet verrekend. Bij een model van 1 credit speelt dat vrijwel nooit.
Waar een creditsport vandaan komt, en wanneer beleid van de eigenaar het overschrijft
De kostenindex meet een standaardantwoord van 1,000 inputtokens plus 500 outputtokens tegen de lijstprijzen van aanbieders. De creditladder wordt afgeleid van een andere referentiebeurt, 3,000 inputtokens en 800 outputtokens, gedeeld door wat diezelfde beurt kost op het ankermodel, wat $0.00156 aan aanbiedersuitgaven is. Het resultaat wordt vervolgens naar boven afgerond op een geldige sport. De ladder telt achttien sporten: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Veertien daarvan dragen vandaag minstens één model, en de vier lege worden bewust aangehouden, omdat een ontbrekende sport het volgende, duurdere model naar de sport erboven zou afronden. Afronden gaat altijd omhoog wanneer een model tussen twee sporten in valt.
Daarnaast worden sommige rijen vastgezet door beleid van de eigenaar in plaats van door rekenkunde. Drie voorbeelden zichtbaar in de tabellen hierboven en in de bredere catalogus:
- De Kimi-familie rekent 10 credits tegenover kostenwaarheden van 2, 3, 4 en 12 afhankelijk van de rij. Daarom staan twee Moonshot-rijen in dollars vlak bij elkaar, op $0.00172 en $0.00185, terwijl beide 10 credits rekenen.
- De Gemini-rij op Starter rekent 1 credit tegenover een kostenwaarheid van 2, wat Starter op een vast tarief van één credit per bericht houdt.
- De GPT Terra-rij rekent 4 credits tegenover een kostenwaarheid van 10.
Rijen met zoekfundering worden weer anders geprijsd, omdat de aanbieder een vast bedrag per zoekopdracht rekent dat niet meeschaalt met het tarief per token. Eén zoekopdracht van $0.005 is 3.2 credits waard, dus kost een enkele zoekopdracht meer dan een heel bericht op het grootste deel van de catalogus. Die sporten zijn ondergrenzen die uitgaan van één zoekopdracht per antwoord.
Een model-identifier zonder enige sport wordt bewust op de top van de ladder gerekend, 100 credits: een ongeprijsd model moet als supportticket naar boven komen in plaats van stilletjes marge op te eten. Een buildtest faalt als een catalogusmodel of agent-identifier zonder sport in productie terechtkomt.
Tot slot wordt creditprijzen per platform ingeschakeld. Een platform op de toegestane lijst ziet echte multipliers in de kiezer en wordt daartegen belast op het creditbudget. Een platform dat daar niet op staat, ziet een vast tarief van één credit per beurt en behoudt het oudere berichtenbudget, namelijk 400 berichten per maand op Starter, 800 op Pro en 5,000 op Powerhouse. De webclient gebruikt vandaag het creditsysteem.
- De goedkoopst geprijsde rij in de index antwoordt één keer voor $0.000053
- Een standaardantwoord is 1,000 inputtokens plus 500 outputtokens, geprijsd op basis van OpenRouter lijstprijzen van 2026-08-20
- Elke kost heeft een ondergrens van één credit, dus geen bericht kost minder dan één
- De meeste allergoedkoopste rijen staan op Powerhouse, omdat alles wat niet op de Starter- of Pro-lijst staat terugvalt op het topabonnement
- Starter bereikt vier identifiers en die kosten allemaal 1 credit, dus 400 credits is 400 berichten
- Gratis accounts hebben geen creditbudget en bereiken twee rijen: Whizi AI en Auto
- De creditsport wordt afgeleid van een andere referentiebeurt dan het indexcijfer, en sommige sporten zijn vastgezet door beleid
Veelgestelde vragen
Wat is het goedkoopste AI-model op Whizi?
Op basis van kosten per standaardantwoord is de goedkoopst geprijsde rij in de Whizi kostenindex Ling van inclusionAI, voor $0.000053, gevolgd door Nex van Nex Agi, Solar Pro van Upstage en de snelle Qwen-laag. Ze rekenen allemaal één credit per bericht. Wat je daadwerkelijk betaalt, staat gelijk aan elke andere rij van één credit, inclusief het Whizi-huismodel, het basis-GPT-model op Starter en verschillende DeepSeek-, Llama- en Gemini-rijen.
Welk abonnement heb ik nodig om de goedkoopste modellen te bereiken?
Dat hangt van de rij af. Verschillende van de allergoedkoopste rijen vereisen Powerhouse, omdat modeltoegang terugvalt op het topabonnement voor elke identifier die niet op de lijst van vier voor Starter of de lijst van 37 voor Pro staat. De goedkope rijen die op Pro bereikbaar zijn, omvatten de DeepSeek-, Llama-, Mistral-, Qwen- en Gemini Flash-items die op deze pagina in de tabellen als Pro zijn gemarkeerd.
Kost een goedkoper model altijd minder credits?
Nee. De twee cijfers worden anders gemeten. De index prijst een standaardantwoord van 1,000 in, 500 uit tegen de lijstprijzen van aanbieders, terwijl de creditsport komt van een referentiebeurt van 3,000 in, 800 uit, naar boven afgerond op een geldige sport op een vaste ladder, waarbij sommige rijen door beleid boven of onder hun rekenkundige waarde zijn vastgezet. Daarom kan een rij van $0.0015 per antwoord één credit rekenen, terwijl een rij van $0.000825 er twee rekent.
Wat gebeurt er met de credit als een antwoord halverwege mislukt?
Die komt terug. Een generatie die mislukt of wordt afgebroken, wordt terugbetaald door de bijbehorende gebruiksregel te verwijderen, zodat het saldo terugkeert naar waar het was. De terugbetaling is gekoppeld aan een door de server gegenereerde request-id in plaats van iets dat de client aanlevert, dus dezelfde terugbetaling twee keer toepassen herstelt precies één beurt en niet twee. Eén ding wordt niet terugbetaald: een beurt die wordt geweigerd wegens onvoldoende budget, verbruikt nog steeds zijn rate-limit-tokens, anders zou een client zonder credits eindeloos opnieuw kunnen proberen.
Kan ik de goedkope modellen zonder abonnement proberen?
Niet op een gratis account, dat alleen Whizi AI en Auto bereikt. Het budget is 7 berichten op de eerste dag, daarna 3 per dag, besteed aan die twee rijen, en het claimen van een gastaccount neemt het gebruik mee naar het geregistreerde account, dus als gast beginnen en je daarna registreren levert geen frisse dag op.