Răspunsul scurt
Cel mai ieftin rând din indexul de costuri Whizi este Ling de la inclusionAI, la $0.000053 pentru un răspuns. Percepe un credit per mesaj, la fel ca orice alt rând din partea de jos a scării, iar pragul minim pe o interacțiune garantează că nimic nu este vreodată taxat sub unu.
Câte un rând ieftin per plan, ca introducere la tabelele complete de mai jos:
| Model | Furnizor | Cost per răspuns | Context | Credite | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Un răspuns standard în index înseamnă 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, astfel încât tarifele de listă de la furnizori diferiți devin comparabile. Prețurile sursă au fost preluate de pe OpenRouter la 2026-08-20. Indexul evaluează 100 de rânduri din 29 de furnizori, iar 89 dintre aceste rânduri poartă o taxă în credite Whizi. Setul complet de date este publicat ca indexul de costuri al modelelor AI.
Această pagină reprezintă capătul ieftin al acelui index. Pentru catalogul pe planuri, vezi lista de modele, iar pentru scara de credite propriu-zisă, vezi referința despre credite.
Rânduri sub o zecime de cent per răspuns
O selecție de rânduri care răspund o dată pentru mai puțin de $0.001 la dimensiunea standard a răspunsului. Toate rândurile listate aici, cu excepția unuia, percep un singur credit.
| Model | Furnizor | Cost per răspuns | Context | Credite | Plan |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Multe dintre cele mai ieftine rânduri au un milion de token-uri sau mai mult, iar cea mai mare fereastră din tot indexul de prețuri aparține unui rând aflat aproape de baza listei de costuri. Ieftin și mic nu sunt aceeași axă aici. Cea mai mică fereastră listată mai sus este 16K.
Cele mai multe dintre aceste rânduri se află pe cel mai scump plan, din motivul explicat mai jos.
Următoarea bandă, până la mediana indexului
Rândul cu prețul median este un rând de raționament Kimi, la $0.00185 per răspuns standard. Un eșantion de rânduri între o zecime de cent și acea mediană:
| Model | Furnizor | Cost per răspuns | Context | Credite | Plan |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
Coloana de credite și coloana de dolari nu acoperă același set de rânduri. Unsprezece din cele 100 de rânduri evaluate nu poartă nicio taxă în credite: sunt evaluate pentru comparație, dar nu sunt oferite ca rând propriu, măsurat, în produs. O cifră în dolari din index nu înseamnă deci, prin ea însăși, că rândul poate fi deschis din selector.
De ce majoritatea celor mai ieftine rânduri sunt Powerhouse
Coloana de plan de mai sus nu este o decizie de preț, ci un mecanism de rezervă. Accesul la modele se stabilește după identificator: mai întâi cei patru identificatori Starter, apoi persoanele de agent, apoi o listă explicită de încă 37 de identificatori pentru Pro, iar orice altceva primește Powerhouse. Un rând ieftin pe care nimeni nu l-a promovat vreodată în lista Pro ajunge deci implicit pe treapta de sus, motiv pentru care baza listei de costuri arată predominant Powerhouse. Mecanismul de rezervă este documentat în lista de modele.
| Plan | La ce ajunge la capătul ieftin |
|---|---|
| Free | Fără alocare de credite. Doar Whizi AI și Auto, 7 mesaje în prima zi, apoi 3 pe zi |
| Starter | Patru identificatori în total: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Toate costă 1 credit |
| Pro | Starter plus încă 37, inclusiv rândurile DeepSeek, Llama, Gemini Flash, Mistral și Qwen marcate Pro mai sus |
| Powerhouse | Tot restul din catalog, acolo unde se află rândurile laboratoarelor mai mici, aflate la baza listei de costuri |
Nivelul gratuit nu este deloc în această comparație: din 2026-09-02 ajunge doar la Whizi AI și Auto și nimic altceva, deci nici cel mai ieftin rând din index, nici cel mai scump nu sunt accesibile pe el. Ce oferă este 7 mesaje în prima zi, apoi 3 pe zi, cheltuite pe aceste două rânduri.
Starter este cel îngust. Ajunge la patru identificatori, fiecare dintre ei percepe un singur credit, iar alocarea sa de 400 de credite echivalează deci cu 400 de mesaje. Nu există niciun model Anthropic pe Starter și niciun acces la rândurile ieftine ale laboratoarelor mai mici din tabelele de mai sus.
Ce cumpără un credit
Un credit este definit ca un mesaj pe modelul casei, care rulează pe modelul de bază OpenAI fixat la un credit. Un test de build eșuează dacă vreunul dintre ele părăsește vreodată acea treaptă, pentru că mutarea oricăruia redenominează întreaga scară.
Taxa este un număr întreg fix per identificator de model. La acest capăt al catalogului, asta înseamnă că un rând de 1 credit costă un credit, indiferent de lungimea intrării sau a ieșirii: lipești un document lung în el, lași răspunsul să curgă lung, iar interacțiunea tot este taxată cu unu.
| Rând | Cost per răspuns | Cost per 1.000 de răspunsuri | Credite |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Transpusă într-o alocare, treapta de jos este singurul loc unde cifra în credite și cifra în mesaje sunt același număr: fiecare interacțiune costă unu, deci o alocare de plan de N credite înseamnă N mesaje atâta timp cât rămâi pe rânduri de 1 credit. Alocarea per plan, resetarea și regula de reportare sunt toate în referința despre credite.
Încă un mecanism care contează la capătul ieftin: o interacțiune care nu încape în soldul rămas este refuzată integral, nu taxată parțial. Douăzeci de credite pe un sold de trei credite rămase este respinsă, nu redusă. Pe un model de 1 credit, asta aproape că nu se întâmplă niciodată.
De unde vine o treaptă de credit și când politica proprietarului o suprascrie
Indexul de costuri măsoară un răspuns standard de 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, comparat cu tarifele de listă ale furnizorilor. Scara de credite este derivată dintr-o interacțiune de referință diferită, 3.000 de token-uri de intrare și 800 de token-uri de ieșire, împărțită la cât costă aceeași interacțiune pe modelul ancoră, adică $0.00156 din cheltuiala furnizorului. Rezultatul este apoi rotunjit în sus până la o treaptă legală. Scara are optsprezece trepte: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Paisprezece au cel puțin un model astăzi, iar cele patru goale sunt păstrate deliberat, pentru că o treaptă lipsă ar rotunji următorul model mai scump până la cea de deasupra. Rotunjirea se face în sus atunci când un model cade între două trepte.
În plus, unele rânduri sunt fixate prin politica proprietarului, nu prin calcul. Trei exemple vizibile în tabelele de mai sus și în catalogul mai larg:
- Familia Kimi este taxată cu 10 credite față de rate reale de cost de 2, 3, 4 și 12 în funcție de rând. De aceea două rânduri Moonshot se află la o distanță de nimic unul de altul în dolari, la $0.00172 și $0.00185, dar amândouă percep 10 credite.
- Rândul Gemini de pe Starter este taxat cu 1 credit față de un cost real de 2, ceea ce menține Starter la un credit fix per mesaj.
- Rândul GPT Terra este taxat cu 4 credite față de un cost real de 10.
Rândurile cu căutare integrată sunt evaluate diferit, pentru că furnizorul percepe o taxă fixă per căutare, care nu se scalează cu tariful per token. O căutare la $0.005 valorează 3,2 credite, deci o singură căutare costă mai mult decât un mesaj întreg pe majoritatea catalogului. Aceste trepte sunt praguri minime care presupun o căutare per răspuns.
Un identificator de model fără nicio treaptă este taxat la vârful scării, 100 de credite, în mod deliberat: un model neevaluat ar trebui să iasă la suprafață ca tichet de suport, nu să erodeze marja pe tăcute. Un test de build eșuează dacă orice model din catalog sau identificator de agent ajunge în producție fără o treaptă.
În final, taxarea în credite este activată per platformă. O platformă de pe lista permisă vede multiplicatori reali în selector și este taxată conform lor din alocarea de credite. O platformă care nu este pe listă vede un credit fix per interacțiune și păstrează vechea alocare de mesaje, adică 400 de mesaje pe lună pe Starter, 800 pe Pro și 5.000 pe Powerhouse. Clientul web este astăzi pe sistemul de credite.
- Cel mai ieftin rând din index răspunde o dată pentru $0.000053
- Un răspuns standard înseamnă 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, evaluat după tarifele de listă OpenRouter din 2026-08-20
- Fiecare taxă are un prag minim de un credit, deci niciun mesaj nu costă mai puțin de unu
- Majoritatea celor mai ieftine rânduri se află pe Powerhouse, pentru că orice nu se află pe lista Starter sau Pro ajunge implicit pe treapta de sus
- Starter ajunge la patru identificatori, iar toți costă 1 credit, deci 400 de credite înseamnă 400 de mesaje
- Conturile Free nu au alocare de credite și ajung la două rânduri: Whizi AI și Auto
- Treapta de credit este derivată dintr-o interacțiune de referință diferită de cifra din index, iar unele trepte sunt fixate prin politică
Întrebări frecvente
Care este cel mai ieftin model AI pe Whizi?
După costul per răspuns standard, cel mai ieftin rând din indexul de costuri Whizi este Ling de la inclusionAI, la $0.000053, urmat de Nex de la Nex Agi, Solar Pro de la Upstage și treapta rapidă Qwen. Toate percep un credit per mesaj. După ce plătești efectiv, sunt la egalitate cu orice alt rând de un credit, inclusiv modelul casei Whizi, modelul de bază GPT de pe Starter și câteva rânduri DeepSeek, Llama și Gemini.
De ce plan am nevoie ca să ajung la cele mai ieftine modele?
Depinde de rând. Câteva dintre cele mai ieftine rânduri necesită Powerhouse, pentru că accesul la modele ajunge implicit pe treapta de sus pentru orice identificator care nu se află pe lista de patru elemente Starter sau pe lista de 37 de elemente Pro. Rândurile ieftine accesibile pe Pro includ intrările DeepSeek, Llama, Mistral, Qwen și Gemini Flash marcate Pro în tabelele de pe această pagină.
Un model mai ieftin costă mereu mai puține credite?
Nu. Cele două cifre sunt măsurate diferit. Indexul evaluează un răspuns standard de 1.000 de intrare, 500 de ieșire față de tarifele de listă ale furnizorilor, în timp ce treapta de credit provine dintr-o interacțiune de referință de 3.000 de intrare, 800 de ieșire, rotunjită în sus la o treaptă legală pe o scară fixă, cu unele rânduri fixate prin politică deasupra sau sub valoarea lor calculată. De aceea un rând la $0.0015 per răspuns poate percepe un credit, în timp ce un rând la $0.000825 percepe două.
Ce se întâmplă cu creditul dacă un răspuns eșuează pe parcurs?
Se returnează. O generare care eșuează sau este întreruptă este rambursată prin ștergerea rândului său de utilizare, astfel încât soldul revine la valoarea de dinainte. Rambursarea este legată de un id de cerere generat de server, nu de orice trimite clientul, deci aplicarea aceleiași rambursări de două ori restaurează exact o interacțiune, nu două. Un lucru care nu este rambursat: o interacțiune respinsă pentru depășirea cotei tot cheltuiește token-urile de limitare a ratei, altfel un client fără credite ar putea reîncerca fără limită.
Pot încerca modelele ieftine fără abonament?
Nu pe un cont gratuit, care ajunge doar la Whizi AI și Auto. Alocarea sa este de 7 mesaje în prima zi, apoi 3 pe zi, cheltuite pe aceste două rânduri, iar revendicarea unui cont de invitat își duce utilizarea în contul înregistrat, deci a începe ca invitat și a te înregistra ulterior nu îți oferă o zi nouă.