I modelli AI più economici per risposta su Whizi, e cosa compra un credito

Risposta rapida

La riga più economica dell'indice dei costi Whizi è Ling di inclusionAI, a $0.000053 per una risposta. Addebita un credito a messaggio, come ogni altra riga in fondo alla scala, e nessun messaggio viene mai addebitato meno di un credito. Una risposta standard equivale a 1.000 token in ingresso più 500 token in uscita.

La risposta breve

La riga più economica dell'indice dei costi Whizi è Ling di inclusionAI, a $0.000053 per una risposta. Addebita un credito a messaggio, come ogni altra riga in fondo alla scala, e il minimo per un turno garantisce che non venga mai addebitato meno di uno.

Una riga economica per piano, come introduzione alle tabelle complete più sotto:

ModelloProviderCosto per rispostaContestoCreditiPiano
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Una risposta standard nell'indice è 1.000 token in ingresso più 500 token in uscita, così le tariffe listino di provider diversi diventano confrontabili. I prezzi sorgente sono stati raccolti da OpenRouter il 2026-08-20. L'indice quota 100 righe su 29 provider, e 89 di queste righe hanno un addebito in crediti Whizi. Il dataset completo è pubblicato come indice dei costi dei modelli AI.

Questa pagina è la fascia economica di quell'indice. Per il catalogo per piano vedi la lista modelli, e per la scala dei crediti vera e propria vedi il riferimento crediti.

Righe sotto un decimo di centesimo per risposta

Una selezione delle righe che rispondono una volta per meno di $0.001 alla dimensione di risposta standard. Tutte tranne una delle righe qui elencate addebitano un solo credito.

ModelloProviderCosto per rispostaContestoCreditiPiano
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Diverse delle righe più economiche hanno un milione di token o più, e la finestra più grande dell'intero indice prezzi appartiene a una riga vicina al fondo della lista costi. Economico e piccolo non sono lo stesso asse qui. La finestra più piccola qui sopra è 16K.

La maggior parte di queste righe si trova sul piano più costoso, per il motivo spiegato più sotto.

La fascia successiva, fino alla mediana dell'indice

La riga di prezzo mediano è una riga di ragionamento Kimi a $0.00185 per risposta standard. Un campione delle righe tra un decimo di centesimo e quella mediana:

ModelloProviderCosto per rispostaContestoCreditiPiano
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

La colonna dei crediti e la colonna dei dollari non coprono lo stesso insieme di righe. Undici delle 100 righe quotate non hanno alcun addebito in crediti: sono quotate per confronto ma non sono offerte come riga a sé metrata nel prodotto. Una cifra in dollari nell'indice quindi non significa di per sé che la riga sia apribile nel selettore.

Perché la maggior parte delle righe più economiche è su Powerhouse

La colonna del piano qui sopra non è una decisione di prezzo, è un fallback. L'accesso ai modelli si risolve per identificatore: prima i quattro identificatori Starter, poi le persone agente, poi una lista esplicita di altri 37 identificatori per Pro, e tutto il resto restituisce Powerhouse. Una riga economica che nessuno ha mai promosso nella lista Pro finisce quindi sul livello più alto per default, ed è per questo che il fondo della lista costi appare come una colonna Powerhouse. Il fallback stesso è documentato sulla lista modelli.

PianoCosa raggiunge alla fascia economica
FreeNessuna dotazione di crediti. Solo Whizi AI e Auto, 7 messaggi il primo giorno poi 3 al giorno
StarterQuattro identificatori in totale: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Tutti costano 1 credito
ProStarter più altri 37, inclusi le righe DeepSeek, Llama, Gemini Flash, Mistral e Qwen segnate Pro sopra
PowerhouseTutto il resto del catalogo, dove si trovano le righe dei laboratori più piccoli in fondo alla lista costi

Il piano free non è in questo confronto affatto: dal 2026-09-02 raggiunge solo Whizi AI e Auto e nient'altro, quindi né la riga più economica dell'indice né quella più costosa sono raggiungibili su di esso. Ciò che offre sono 7 messaggi il primo giorno, poi 3 al giorno, spesi su quelle due righe.

Starter è quello ristretto. Raggiunge quattro identificatori, ognuno dei quali addebita un singolo credito, e la sua dotazione di 400 crediti equivale quindi a 400 messaggi. Non c'è alcun modello Anthropic su Starter, né accesso alle righe economiche dei laboratori più piccoli nelle tabelle sopra.

Cosa compra un credito

Un credito è definito come un messaggio sul modello di casa, che gira sul modello base OpenAI fissato a un credito. Un test di build fallisce se uno dei due lascia mai quel gradino, perché spostare l'uno o l'altro ridenomina l'intera scala.

L'addebito è un intero fisso per id modello. A questo estremo del catalogo significa che una riga a 1 credito costa un credito qualunque sia la lunghezza dell'input o dell'output: incolla un documento lungo, lascia che la risposta si dilunghi, e il turno viene comunque addebitato uno.

RigaCosto per rispostaCosto per 1.000 risposteCrediti
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Tradotto in dotazione, il gradino più basso è l'unico punto in cui la cifra in crediti e la cifra in messaggi coincidono: ogni turno costa uno, quindi una dotazione di piano di N crediti equivale a N messaggi finché resti su righe a 1 credito. La dotazione per piano, il reset e la regola di riporto sono tutti nel riferimento crediti.

Un altro meccanismo che conta alla fascia economica: un turno che non entra nel saldo residuo viene rifiutato per intero, non addebitato in parte. Venti crediti su tre crediti residui viene respinto, non scontato. Su un modello a 1 credito questo quasi non accade mai.

Da dove viene un gradino di credito, e quando la policy del proprietario lo sovrascrive

L'indice dei costi misura una risposta standard di 1.000 token in ingresso più 500 in uscita contro le tariffe listino dei provider. La scala dei crediti deriva da un turno di riferimento diverso, 3.000 token in ingresso e 800 in uscita, diviso per quanto costa quello stesso turno sul modello di ancoraggio, cioè $0.00156 di spesa provider. Il risultato viene poi arrotondato per eccesso a un gradino legale. La scala ne conta diciotto: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Quattordici hanno oggi almeno un modello, e i quattro vuoti sono mantenuti deliberatamente, perché un gradino mancante farebbe arrotondare il modello più costoso successivo verso quello sopra. L'arrotondamento va verso l'alto quando un modello cade tra due gradini.

Oltre a questo, alcune righe sono fissate per policy del proprietario invece che per calcolo aritmetico. Tre esempi visibili nelle tabelle sopra e nel catalogo più ampio:

  • La famiglia Kimi viene addebitata 10 crediti contro tariffe reali di 2, 3, 4 e 12 a seconda della riga. Per questo due righe Moonshot si trovano quasi identiche in dollari, a $0.00172 e $0.00185, eppure addebitano entrambe 10 crediti.
  • La riga Gemini su Starter viene addebitata 1 credito contro un valore reale di 2, il che è ciò che mantiene Starter a un credito piatto per messaggio.
  • La riga GPT Terra viene addebitata 4 crediti contro un valore reale di 10.

Le righe con ricerca integrata sono quotate in modo ancora diverso, perché il provider addebita una tariffa fissa per ricerca che non scala con la tariffa per token. Una ricerca a $0.005 vale 3,2 crediti, quindi una singola ricerca costa più di un intero messaggio sulla maggior parte del catalogo. Quei gradini sono soglie minime che presumono una ricerca per risposta.

Un identificatore di modello senza alcun gradino viene addebitato al massimo della scala, 100 crediti, deliberatamente: un modello senza prezzo dovrebbe emergere come ticket di supporto invece che erodere silenziosamente il margine. Un test di build fallisce se un modello del catalogo o un identificatore agente arriva in produzione senza un gradino.

Infine, il prezzo in crediti è abilitato per piattaforma. Una piattaforma nella allowlist vede i moltiplicatori reali nel selettore e viene addebitata di conseguenza sulla dotazione di crediti. Una piattaforma che non c'è vede un credito piatto a turno e mantiene invece la vecchia dotazione a messaggi, che è 400 messaggi al mese su Starter, 800 su Pro e 5.000 su Powerhouse. Il client web è oggi sul sistema a crediti.

Lista di controllo
  • La riga più economica dell'indice risponde una volta per $0.000053
  • Una risposta standard è 1.000 token in ingresso più 500 in uscita, quotati sulle tariffe listino OpenRouter del 2026-08-20
  • Ogni addebito ha un minimo di un credito, quindi nessun messaggio costa meno di uno
  • La maggior parte delle righe più economiche in assoluto è su Powerhouse, perché tutto ciò che non è nella lista Starter o Pro ricade sul livello più alto
  • Starter raggiunge quattro identificatori e tutti costano 1 credito, quindi 400 crediti equivalgono a 400 messaggi
  • Gli account free non hanno dotazione di crediti e raggiungono due righe: Whizi AI e Auto
  • Il gradino di credito deriva da un turno di riferimento diverso da quello dell'indice, e alcuni gradini sono fissati per policy

Domande frequenti

Qual è il modello AI più economico su Whizi?

Per costo per risposta standard, la riga più economica dell'indice dei costi Whizi è Ling di inclusionAI a $0.000053, seguita da Nex di Nex Agi, Solar Pro di Upstage e il livello veloce di Qwen. Tutte addebitano un credito a messaggio. Per quanto effettivamente paghi, sono a pari merito con ogni altra riga a un credito, incluso il modello di casa Whizi, il modello base GPT su Starter e diverse righe DeepSeek, Llama e Gemini.

Di quale piano ho bisogno per raggiungere i modelli più economici?

Dipende dalla riga. Diverse delle righe più economiche in assoluto richiedono Powerhouse, perché l'accesso ai modelli ricade sul livello più alto per qualsiasi identificatore che non sia nella lista Starter a quattro voci o nella lista Pro a 37 voci. Le righe economiche raggiungibili su Pro includono le voci DeepSeek, Llama, Mistral, Qwen e Gemini Flash segnate Pro nelle tabelle di questa pagina.

Un modello più economico costa sempre meno crediti?

No. Le due cifre sono misurate in modo diverso. L'indice quota una risposta standard 1.000 in ingresso, 500 in uscita contro le tariffe listino dei provider, mentre il gradino di credito viene da un turno di riferimento 3.000 in ingresso, 800 in uscita arrotondato per eccesso a un gradino legale su una scala fissa, con alcune righe fissate per policy sopra o sotto il loro valore aritmetico. Per questo una riga a $0.0015 per risposta può addebitare un credito mentre una riga a $0.000825 ne addebita due.

Cosa succede al credito se una risposta fallisce a metà?

Torna indietro. Una generazione che fallisce o viene interrotta viene rimborsata cancellando la sua riga di utilizzo, così il saldo torna dov'era. Il rimborso è associato a un id di richiesta generato dal server e non a qualcosa fornito dal client, quindi applicare lo stesso rimborso due volte restituisce esattamente un turno e non due. Una cosa che non viene rimborsata: un turno respinto per quota esaurita spende comunque i suoi token di rate limit, altrimenti un client senza crediti potrebbe riprovare senza limiti.

Posso provare i modelli economici senza abbonamento?

Non con un account free, che raggiunge solo Whizi AI e Auto. La sua dotazione è 7 messaggi il primo giorno, poi 3 al giorno, spesi su quelle due righe, e il claim di un account ospite porta il suo utilizzo nell'account registrato, quindi iniziare come ospite e registrarsi dopo non restituisce un giorno nuovo.