Det korta svaret
Den billigast prissatta raden i Whizis kostnadsindex är Ling från inclusionAI, till $0.000053 för att svara en gång. Den debiterar en kredit per meddelande, precis som alla andra rader längst ner på stegen, och golvet för en tur garanterar att inget någonsin debiteras mindre än en.
En billig rad per abonnemang, som en introduktion till de fullständiga tabellerna nedan:
| Modell | Leverantör | Kostnad per svar | Kontext | Krediter | Abonnemang |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Ett standardsvar i indexet är 1 000 inputtoken plus 500 outputtoken, vilket gör att listpriser från olika leverantörer blir jämförbara. Källpriserna hämtades från OpenRouter den 2026-08-20. Indexet prissätter 100 rader hos 29 leverantörer, och 89 av dessa rader har en Whizi-kreditkostnad. Hela datasetet publiceras som AI-modellernas kostnadsindex.
Den här sidan är den billiga änden av indexet. För katalogen efter abonnemang, se modellistan, och för själva kreditstegen, se kreditreferensen.
Rader under en tiondels cent per svar
Ett urval av raderna som svarar en gång för mindre än $0.001 vid standardsvarets storlek. Alla utom en av raderna som visas här debiterar en enda kredit.
| Modell | Leverantör | Kostnad per svar | Kontext | Krediter | Abonnemang |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Flera av de billigaste raderna har en miljon token eller mer, och det största kontextfönstret i hela prisindexet tillhör en rad nära botten av kostnadslistan. Billigt och litet är inte samma axel här. Det minsta fönstret som visas ovan är 16K.
De flesta av dessa rader ligger på det dyraste abonnemanget, av skälet som beskrivs nedan.
Nästa skikt, upp till indexets median
Den median-prissatta raden är en Kimi-resoneringsrad på $0.00185 per standardsvar. Ett urval av raderna mellan en tiondels cent och den medianen:
| Modell | Leverantör | Kostnad per svar | Kontext | Krediter | Abonnemang |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
Kreditkolumnen och dollarkolumnen täcker inte samma uppsättning rader. Elva av de 100 prissatta raderna har ingen kreditkostnad alls: de prissätts för jämförelse men erbjuds inte som en egen mätbar rad i produkten. En dollarsiffra i indexet betyder därför inte i sig att raden kan öppnas i väljaren.
Varför de flesta av de billigaste raderna är Powerhouse
Abonnemangskolumnen ovan är inte ett prissättningsbeslut, det är en fallback. Modelltillgång avgörs efter identifierare: de fyra Starter-identifierarna först, sedan agentpersonorna, sedan en uttrycklig lista med 37 ytterligare identifierare för Pro, och allt annat ger Powerhouse. En billig rad som ingen någonsin flyttade upp till Pro-listan hamnar därför på den översta nivån som standard, vilket är varför botten av kostnadslistan läses som en Powerhouse-kolumn. Fallbacken i sig är dokumenterad i modellistan.
| Abonnemang | Vad det når i den billiga änden |
|---|---|
| Free | Ingen kreditkvot. Endast Whizi AI och Auto, 7 meddelanden första dagen och sedan 3 om dagen |
| Starter | Fyra identifierare totalt: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Alla kostar 1 kredit |
| Pro | Starter plus 38 till, inklusive DeepSeek-, Llama-, Gemini Flash-, Mistral- och Qwen-raderna markerade Pro ovan |
| Powerhouse | Allt annat i katalogen, vilket är där raderna från de mindre labben längst ner i kostnadslistan ligger |
Den fria nivån är inte med i den här jämförelsen alls: sedan 2026-09-02 når den bara Whizi AI och Auto och inget annat, så varken den billigaste raden i indexet eller den dyraste går att nå på den. Vad den ger är 7 meddelanden första dagen, sedan 3 om dagen, spenderade på dessa två rader.
Starter är den smala varianten. Den når fyra identifierare, var och en av dem debiterar en enda kredit, och dess kvot på 600 krediter motsvarar därför 600 meddelanden. Det finns ingen Anthropic-modell på Starter, och ingen tillgång till de billiga raderna från mindre labb i tabellerna ovan.
Vad en kredit räcker till
En kredit definieras som ett meddelande på husmodellen, som körs på OpenAIs basmodell fastnålad på en kredit. Ett bygg-test misslyckas om någon av dem någonsin lämnar den nivån, eftersom en flytt av endera skulle omdenominera hela stegen.
Kostnaden är ett fast heltal per modell-id. I denna ände av katalogen innebär det att en rad på 1 kredit kostar en kredit oavsett in- eller utmatningens längd: klistra in ett långt dokument i den, låt svaret bli långt, och turen debiteras fortfarande en.
| Rad | Kostnad per svar | Kostnad per 1 000 svar | Krediter |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Omvandlat till en kvot är den nedersta nivån den enda platsen där kreditsiffran och meddelandesiffran är samma tal: varje tur kostar en, så en abonnemangskvot på N krediter är N meddelanden så länge du håller dig på rader med 1 kredit. Kvoten per abonnemang, återställningen och rullningsregeln finns alla i kreditreferensen.
En till mekanik som spelar roll i den billiga änden: en tur som inte får plats i det återstående saldot avvisas helt i stället för att delvis debiteras. Tjugo krediter på tre återstående krediter avslås, rabatteras inte. På en modell med 1 kredit slår detta nästan aldrig till.
Var en kreditnivå kommer från, och när ägarens policy åsidosätter den
Kostnadsindexet mäter ett standardsvar på 1 000 inputtoken plus 500 outputtoken mot leverantörernas listpriser. Kreditstegen härleds från en annan referenstur, 3 000 inputtoken och 800 outputtoken, delat med vad samma tur kostar på ankarmodellen, vilket är $0.00156 i leverantörskostnad. Resultatet avrundas därefter uppåt till en giltig nivå. Stegen har arton nivåer: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Fjorton har minst en modell idag, och de fyra tomma hålls kvar avsiktligt, eftersom en saknad nivå skulle avrunda nästa dyrare modell uppåt till nivån ovanför. Avrundning sker uppåt när en modell hamnar mellan två nivåer.
Utöver det är vissa rader fastnålade av ägarens policy snarare än av aritmetik. Tre exempel som syns i tabellerna ovan och i den bredare katalogen:
- Kimi-familjen debiteras 10 krediter mot kostnadskorrekta nivåer på 2, 3, 4 och 12 beroende på raden. Det är därför två Moonshot-rader ligger inom en hårsmån av varandra i dollar, på $0.00172 och $0.00185, men båda debiterar 10 krediter.
- Gemini-raden på Starter debiteras 1 kredit mot en kostnadskorrekt 2, vilket är det som håller Starter på en jämn kredit per meddelande.
- GPT Terra-raden debiteras 4 krediter mot en kostnadskorrekt 10.
Sökbaserade rader prissätts återigen annorlunda, eftersom leverantören tar en fast avgift per sökning som inte skalar med per-token-priset. En sökning på $0.005 är värd 3,2 krediter, så en enda sökning kostar mer än ett helt meddelande på det mesta av katalogen. Dessa nivåer är golv som förutsätter en sökning per svar.
En modellidentifierare utan någon nivå alls debiteras stegens topp, 100 krediter, avsiktligt: en oprissatt modell ska synas som ett supportärende i stället för att tyst äta upp marginalen. Ett bygg-test misslyckas om någon modell eller agentidentifierare i katalogen når produktion utan en nivå.
Slutligen aktiveras kreditprissättning per plattform. En plattform på tillåtelselistan ser riktiga multiplikatorer i väljaren och debiteras dem mot kreditkvoten. En plattform som inte är det ser en jämn kredit per tur och behåller istället den äldre meddelandekvoten, vilket är 600 meddelanden per månad på Starter, 800 på Pro och 5 000 på Powerhouse. Webbklienten använder kreditsystemet idag.
- Den billigast prissatta raden i indexet svarar en gång för $0.000053
- Ett standardsvar är 1 000 inputtoken plus 500 outputtoken, prissatt från OpenRouters listpriser den 2026-08-20
- Varje debitering har ett golv på en kredit, så inget meddelande kostar mindre än en
- De flesta av de allra billigaste raderna ligger på Powerhouse, eftersom allt som inte finns på Starter- eller Pro-listan faller igenom till den översta nivån
- Starter når fyra identifierare och alla kostar 1 kredit, så 600 krediter är 600 meddelanden
- Gratiskonton har ingen kreditkvot och når två rader: Whizi AI och Auto
- Kreditnivån härleds från en annan referenstur än indexsiffran, och vissa nivåer är fastnålade av policy
Vanliga frågor
Vilken är den billigaste AI-modellen på Whizi?
Räknat i kostnad per standardsvar är den billigast prissatta raden i Whizis kostnadsindex Ling från inclusionAI på $0.000053, följd av Nex från Nex Agi, Solar Pro från Upstage och Qwens snabba nivå. Alla debiterar en kredit per meddelande. Räknat i vad du faktiskt betalar är de likställda med alla andra rader på 1 kredit, inklusive Whizis husmodell, basmodellen GPT på Starter och flera DeepSeek-, Llama- och Gemini-rader.
Vilket abonnemang behöver jag för att nå de billigaste modellerna?
Det beror på raden. Flera av de allra billigaste raderna kräver Powerhouse, eftersom modelltillgången faller igenom till den översta nivån för alla identifierare som inte finns på Starters lista med fyra poster eller Pros lista med 37 poster. De billiga rader som går att nå på Pro inkluderar DeepSeek-, Llama-, Mistral-, Qwen- och Gemini Flash-posterna markerade Pro i tabellerna på den här sidan.
Kostar en billigare modell alltid färre krediter?
Nej. De två siffrorna mäts olika. Indexet prissätter ett standardsvar på 1 000 in, 500 ut mot leverantörernas listpriser, medan kreditnivån kommer från en referenstur på 3 000 in, 800 ut avrundad uppåt till en giltig nivå på en fast stege, där vissa rader är fastnålade av policy över eller under sin aritmetik. Det är därför en rad på $0.0015 per svar kan debitera en kredit medan en rad på $0.000825 debiterar två.
Vad händer med krediten om ett svar misslyckas halvvägs?
Den kommer tillbaka. En generering som misslyckas eller avbryts återbetalas genom att dess användningsrad tas bort, så saldot återgår till vad det var. Återbetalningen är knuten till ett server-genererat förfrågnings-id snarare än något klienten anger, så att tillämpa samma återbetalning två gånger återställer exakt en tur och inte två. En sak som inte återbetalas: en tur som avslås för att vara utanför kvoten förbrukar fortfarande sina hastighetsbegränsningstoken, annars skulle en klient utan krediter kunna försöka om utan gräns.
Kan jag prova de billiga modellerna utan ett abonnemang?
Inte på ett gratiskonto, som endast når Whizi AI och Auto. Dess kvot är 7 meddelanden första dagen, sedan 3 om dagen, spenderade på dessa två rader, och att göra anspråk på ett gästkonto för med sig dess användning till det registrerade kontot, så att börja som gäst och registrera sig efteråt ger inte tillbaka en ny dag.