Cele mai ieftine modele AI per răspuns în Whizi și ce cumpără un credit

Răspuns rapid

Cel mai ieftin rând din indexul de costuri Whizi este Ling de la inclusionAI, la $0.000053 pentru un răspuns. Percepe un credit per mesaj, la fel ca orice alt rând din partea de jos a scării, și niciun mesaj nu este vreodată taxat sub un credit. Un răspuns standard înseamnă 1.000 de token-uri de intrare plus 500 de token-uri de ieșire.

Răspunsul scurt

Cel mai ieftin rând din indexul de costuri Whizi este Ling de la inclusionAI, la $0.000053 pentru un răspuns. Percepe un credit per mesaj, la fel ca orice alt rând din partea de jos a scării, iar pragul minim pe o interacțiune garantează că nimic nu este vreodată taxat sub unu.

Câte un rând ieftin per plan, ca introducere la tabelele complete de mai jos:

ModelFurnizorCost per răspunsContextCreditePlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Un răspuns standard în index înseamnă 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, astfel încât tarifele de listă de la furnizori diferiți devin comparabile. Prețurile sursă au fost preluate de pe OpenRouter la 2026-08-20. Indexul evaluează 100 de rânduri din 29 de furnizori, iar 89 dintre aceste rânduri poartă o taxă în credite Whizi. Setul complet de date este publicat ca indexul de costuri al modelelor AI.

Această pagină reprezintă capătul ieftin al acelui index. Pentru catalogul pe planuri, vezi lista de modele, iar pentru scara de credite propriu-zisă, vezi referința despre credite.

Rânduri sub o zecime de cent per răspuns

O selecție de rânduri care răspund o dată pentru mai puțin de $0.001 la dimensiunea standard a răspunsului. Toate rândurile listate aici, cu excepția unuia, percep un singur credit.

ModelFurnizorCost per răspunsContextCreditePlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Multe dintre cele mai ieftine rânduri au un milion de token-uri sau mai mult, iar cea mai mare fereastră din tot indexul de prețuri aparține unui rând aflat aproape de baza listei de costuri. Ieftin și mic nu sunt aceeași axă aici. Cea mai mică fereastră listată mai sus este 16K.

Cele mai multe dintre aceste rânduri se află pe cel mai scump plan, din motivul explicat mai jos.

Următoarea bandă, până la mediana indexului

Rândul cu prețul median este un rând de raționament Kimi, la $0.00185 per răspuns standard. Un eșantion de rânduri între o zecime de cent și acea mediană:

ModelFurnizorCost per răspunsContextCreditePlan
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

Coloana de credite și coloana de dolari nu acoperă același set de rânduri. Unsprezece din cele 100 de rânduri evaluate nu poartă nicio taxă în credite: sunt evaluate pentru comparație, dar nu sunt oferite ca rând propriu, măsurat, în produs. O cifră în dolari din index nu înseamnă deci, prin ea însăși, că rândul poate fi deschis din selector.

De ce majoritatea celor mai ieftine rânduri sunt Powerhouse

Coloana de plan de mai sus nu este o decizie de preț, ci un mecanism de rezervă. Accesul la modele se stabilește după identificator: mai întâi cei patru identificatori Starter, apoi persoanele de agent, apoi o listă explicită de încă 37 de identificatori pentru Pro, iar orice altceva primește Powerhouse. Un rând ieftin pe care nimeni nu l-a promovat vreodată în lista Pro ajunge deci implicit pe treapta de sus, motiv pentru care baza listei de costuri arată predominant Powerhouse. Mecanismul de rezervă este documentat în lista de modele.

PlanLa ce ajunge la capătul ieftin
FreeFără alocare de credite. Doar Whizi AI și Auto, 7 mesaje în prima zi, apoi 3 pe zi
StarterPatru identificatori în total: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Toate costă 1 credit
ProStarter plus încă 37, inclusiv rândurile DeepSeek, Llama, Gemini Flash, Mistral și Qwen marcate Pro mai sus
PowerhouseTot restul din catalog, acolo unde se află rândurile laboratoarelor mai mici, aflate la baza listei de costuri

Nivelul gratuit nu este deloc în această comparație: din 2026-09-02 ajunge doar la Whizi AI și Auto și nimic altceva, deci nici cel mai ieftin rând din index, nici cel mai scump nu sunt accesibile pe el. Ce oferă este 7 mesaje în prima zi, apoi 3 pe zi, cheltuite pe aceste două rânduri.

Starter este cel îngust. Ajunge la patru identificatori, fiecare dintre ei percepe un singur credit, iar alocarea sa de 400 de credite echivalează deci cu 400 de mesaje. Nu există niciun model Anthropic pe Starter și niciun acces la rândurile ieftine ale laboratoarelor mai mici din tabelele de mai sus.

Ce cumpără un credit

Un credit este definit ca un mesaj pe modelul casei, care rulează pe modelul de bază OpenAI fixat la un credit. Un test de build eșuează dacă vreunul dintre ele părăsește vreodată acea treaptă, pentru că mutarea oricăruia redenominează întreaga scară.

Taxa este un număr întreg fix per identificator de model. La acest capăt al catalogului, asta înseamnă că un rând de 1 credit costă un credit, indiferent de lungimea intrării sau a ieșirii: lipești un document lung în el, lași răspunsul să curgă lung, iar interacțiunea tot este taxată cu unu.

RândCost per răspunsCost per 1.000 de răspunsuriCredite
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Transpusă într-o alocare, treapta de jos este singurul loc unde cifra în credite și cifra în mesaje sunt același număr: fiecare interacțiune costă unu, deci o alocare de plan de N credite înseamnă N mesaje atâta timp cât rămâi pe rânduri de 1 credit. Alocarea per plan, resetarea și regula de reportare sunt toate în referința despre credite.

Încă un mecanism care contează la capătul ieftin: o interacțiune care nu încape în soldul rămas este refuzată integral, nu taxată parțial. Douăzeci de credite pe un sold de trei credite rămase este respinsă, nu redusă. Pe un model de 1 credit, asta aproape că nu se întâmplă niciodată.

De unde vine o treaptă de credit și când politica proprietarului o suprascrie

Indexul de costuri măsoară un răspuns standard de 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, comparat cu tarifele de listă ale furnizorilor. Scara de credite este derivată dintr-o interacțiune de referință diferită, 3.000 de token-uri de intrare și 800 de token-uri de ieșire, împărțită la cât costă aceeași interacțiune pe modelul ancoră, adică $0.00156 din cheltuiala furnizorului. Rezultatul este apoi rotunjit în sus până la o treaptă legală. Scara are optsprezece trepte: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Paisprezece au cel puțin un model astăzi, iar cele patru goale sunt păstrate deliberat, pentru că o treaptă lipsă ar rotunji următorul model mai scump până la cea de deasupra. Rotunjirea se face în sus atunci când un model cade între două trepte.

În plus, unele rânduri sunt fixate prin politica proprietarului, nu prin calcul. Trei exemple vizibile în tabelele de mai sus și în catalogul mai larg:

  • Familia Kimi este taxată cu 10 credite față de rate reale de cost de 2, 3, 4 și 12 în funcție de rând. De aceea două rânduri Moonshot se află la o distanță de nimic unul de altul în dolari, la $0.00172 și $0.00185, dar amândouă percep 10 credite.
  • Rândul Gemini de pe Starter este taxat cu 1 credit față de un cost real de 2, ceea ce menține Starter la un credit fix per mesaj.
  • Rândul GPT Terra este taxat cu 4 credite față de un cost real de 10.

Rândurile cu căutare integrată sunt evaluate diferit, pentru că furnizorul percepe o taxă fixă per căutare, care nu se scalează cu tariful per token. O căutare la $0.005 valorează 3,2 credite, deci o singură căutare costă mai mult decât un mesaj întreg pe majoritatea catalogului. Aceste trepte sunt praguri minime care presupun o căutare per răspuns.

Un identificator de model fără nicio treaptă este taxat la vârful scării, 100 de credite, în mod deliberat: un model neevaluat ar trebui să iasă la suprafață ca tichet de suport, nu să erodeze marja pe tăcute. Un test de build eșuează dacă orice model din catalog sau identificator de agent ajunge în producție fără o treaptă.

În final, taxarea în credite este activată per platformă. O platformă de pe lista permisă vede multiplicatori reali în selector și este taxată conform lor din alocarea de credite. O platformă care nu este pe listă vede un credit fix per interacțiune și păstrează vechea alocare de mesaje, adică 400 de mesaje pe lună pe Starter, 800 pe Pro și 5.000 pe Powerhouse. Clientul web este astăzi pe sistemul de credite.

Listă de verificare
  • Cel mai ieftin rând din index răspunde o dată pentru $0.000053
  • Un răspuns standard înseamnă 1.000 de token-uri de intrare plus 500 de token-uri de ieșire, evaluat după tarifele de listă OpenRouter din 2026-08-20
  • Fiecare taxă are un prag minim de un credit, deci niciun mesaj nu costă mai puțin de unu
  • Majoritatea celor mai ieftine rânduri se află pe Powerhouse, pentru că orice nu se află pe lista Starter sau Pro ajunge implicit pe treapta de sus
  • Starter ajunge la patru identificatori, iar toți costă 1 credit, deci 400 de credite înseamnă 400 de mesaje
  • Conturile Free nu au alocare de credite și ajung la două rânduri: Whizi AI și Auto
  • Treapta de credit este derivată dintr-o interacțiune de referință diferită de cifra din index, iar unele trepte sunt fixate prin politică

Întrebări frecvente

Care este cel mai ieftin model AI pe Whizi?

După costul per răspuns standard, cel mai ieftin rând din indexul de costuri Whizi este Ling de la inclusionAI, la $0.000053, urmat de Nex de la Nex Agi, Solar Pro de la Upstage și treapta rapidă Qwen. Toate percep un credit per mesaj. După ce plătești efectiv, sunt la egalitate cu orice alt rând de un credit, inclusiv modelul casei Whizi, modelul de bază GPT de pe Starter și câteva rânduri DeepSeek, Llama și Gemini.

De ce plan am nevoie ca să ajung la cele mai ieftine modele?

Depinde de rând. Câteva dintre cele mai ieftine rânduri necesită Powerhouse, pentru că accesul la modele ajunge implicit pe treapta de sus pentru orice identificator care nu se află pe lista de patru elemente Starter sau pe lista de 37 de elemente Pro. Rândurile ieftine accesibile pe Pro includ intrările DeepSeek, Llama, Mistral, Qwen și Gemini Flash marcate Pro în tabelele de pe această pagină.

Un model mai ieftin costă mereu mai puține credite?

Nu. Cele două cifre sunt măsurate diferit. Indexul evaluează un răspuns standard de 1.000 de intrare, 500 de ieșire față de tarifele de listă ale furnizorilor, în timp ce treapta de credit provine dintr-o interacțiune de referință de 3.000 de intrare, 800 de ieșire, rotunjită în sus la o treaptă legală pe o scară fixă, cu unele rânduri fixate prin politică deasupra sau sub valoarea lor calculată. De aceea un rând la $0.0015 per răspuns poate percepe un credit, în timp ce un rând la $0.000825 percepe două.

Ce se întâmplă cu creditul dacă un răspuns eșuează pe parcurs?

Se returnează. O generare care eșuează sau este întreruptă este rambursată prin ștergerea rândului său de utilizare, astfel încât soldul revine la valoarea de dinainte. Rambursarea este legată de un id de cerere generat de server, nu de orice trimite clientul, deci aplicarea aceleiași rambursări de două ori restaurează exact o interacțiune, nu două. Un lucru care nu este rambursat: o interacțiune respinsă pentru depășirea cotei tot cheltuiește token-urile de limitare a ratei, altfel un client fără credite ar putea reîncerca fără limită.

Pot încerca modelele ieftine fără abonament?

Nu pe un cont gratuit, care ajunge doar la Whizi AI și Auto. Alocarea sa este de 7 mesaje în prima zi, apoi 3 pe zi, cheltuite pe aceste două rânduri, iar revendicarea unui cont de invitat își duce utilizarea în contul înregistrat, deci a începe ca invitat și a te înregistra ulterior nu îți oferă o zi nouă.