La risposta breve
La riga più economica dell'indice dei costi Whizi è Ling di inclusionAI, a $0.000053 per una risposta. Addebita un credito a messaggio, come ogni altra riga in fondo alla scala, e il minimo per un turno garantisce che non venga mai addebitato meno di uno.
Una riga economica per piano, come introduzione alle tabelle complete più sotto:
| Modello | Provider | Costo per risposta | Contesto | Crediti | Piano |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
Una risposta standard nell'indice è 1.000 token in ingresso più 500 token in uscita, così le tariffe listino di provider diversi diventano confrontabili. I prezzi sorgente sono stati raccolti da OpenRouter il 2026-08-20. L'indice quota 100 righe su 29 provider, e 89 di queste righe hanno un addebito in crediti Whizi. Il dataset completo è pubblicato come indice dei costi dei modelli AI.
Questa pagina è la fascia economica di quell'indice. Per il catalogo per piano vedi la lista modelli, e per la scala dei crediti vera e propria vedi il riferimento crediti.
Righe sotto un decimo di centesimo per risposta
Una selezione delle righe che rispondono una volta per meno di $0.001 alla dimensione di risposta standard. Tutte tranne una delle righe qui elencate addebitano un solo credito.
| Modello | Provider | Costo per risposta | Contesto | Crediti | Piano |
|---|---|---|---|---|---|
| Ling-3.0-flash | inclusionAI | $0.000053 | 262K | 1 | Powerhouse |
| Nex-N2-Mini | Nex Agi | $0.000075 | 262K | 1 | Powerhouse |
| Solar Pro 4 | Upstage | $0.00009 | 524K | 1 | Powerhouse |
| Qwen3.7 Flash | Qwen | $0.000095 | 1M | 1 | Powerhouse |
| Granite 4.1 8B | IBM | $0.0001 | 131K | 1 | Powerhouse |
| Laguna XS 2.1 | Poolside | $0.00012 | 262K | 1 | Powerhouse |
| Phi 4 | Microsoft | $0.00014 | 16K | 1 | Powerhouse |
| Nemotron 3.5 Lightning | NVIDIA | $0.00018 | 262K | 1 | Powerhouse |
| Llama 3.3 70B Instruct | Meta | $0.00026 | 131K | 1 | Pro |
| DeepSeek V4 Flash 0731 | DeepSeek | $0.00028 | 1.31M | 1 | Powerhouse |
| Gemini 2.5 Flash Lite | $0.0003 | 1M | 1 | Pro | |
| DeepSeek V3.2 | DeepSeek | $0.000469 | 164K | 1 | Pro |
| Qwen3 Coder Next | Qwen | $0.00052 | 262K | 1 | Powerhouse |
| Llama 4 Maverick | Meta | $0.0006 | 1M | 1 | Pro |
| DeepSeek V3.1 | DeepSeek | $0.000725 | 164K | 1 | Pro |
| Codestral 2508 | Mistral | $0.00075 | 256K | 1 | Powerhouse |
| Qwen3.6 Flash | Qwen | $0.00075 | 1M | 1 | Powerhouse |
| MiniMax M2 | MiniMax | $0.000765 | 205K | 1 | Powerhouse |
| GPT-5.6 Luna | OpenAI | $0.0008 | 1M | 1 | Starter |
| GPT-5.4 Nano | OpenAI | $0.000825 | 400K | 2 | Powerhouse |
| MiniMax M3 | MiniMax | $0.0009 | 1M | 1 | Powerhouse |
| Qwen3.7 Plus | Qwen | $0.00096 | 1M | 1 | Pro |
Diverse delle righe più economiche hanno un milione di token o più, e la finestra più grande dell'intero indice prezzi appartiene a una riga vicina al fondo della lista costi. Economico e piccolo non sono lo stesso asse qui. La finestra più piccola qui sopra è 16K.
La maggior parte di queste righe si trova sul piano più costoso, per il motivo spiegato più sotto.
La fascia successiva, fino alla mediana dell'indice
La riga di prezzo mediano è una riga di ragionamento Kimi a $0.00185 per risposta standard. Un campione delle righe tra un decimo di centesimo e quella mediana:
| Modello | Provider | Costo per risposta | Contesto | Crediti | Piano |
|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | $0.001 | 1M | 1 | Powerhouse | |
| Muse Glimmer 30B | Meta | $0.0011 | 131K | 2 | Powerhouse |
| Mistral Large 3 2512 | Mistral | $0.00125 | 262K | 2 | Pro |
| GLM 4.7 | Z.ai | $0.001275 | 205K | 2 | Powerhouse |
| Gemini 3.7 Flash | $0.001313 | 1M | 2 | Pro | |
| Mistral Medium 3.1 | Mistral | $0.0014 | 131K | 2 | Pro |
| GLM 4.6 | Z.ai | $0.0015 | 205K | 1 | Powerhouse |
| Gemini 2.5 Flash | $0.00155 | 1M | 2 | Pro | |
| Gemini 3.5 Flash Lite | $0.00155 | 1M | 2 | Powerhouse | |
| GLM 5 | Z.ai | $0.00156 | 205K | 2 | Pro |
| Kimi K2 0711 | Moonshot | $0.00172 | 131K | 10 | Powerhouse |
| Kimi K2 Thinking | Moonshot | $0.00185 | 262K | 10 | Powerhouse |
La colonna dei crediti e la colonna dei dollari non coprono lo stesso insieme di righe. Undici delle 100 righe quotate non hanno alcun addebito in crediti: sono quotate per confronto ma non sono offerte come riga a sé metrata nel prodotto. Una cifra in dollari nell'indice quindi non significa di per sé che la riga sia apribile nel selettore.
Perché la maggior parte delle righe più economiche è su Powerhouse
La colonna del piano qui sopra non è una decisione di prezzo, è un fallback. L'accesso ai modelli si risolve per identificatore: prima i quattro identificatori Starter, poi le persone agente, poi una lista esplicita di altri 37 identificatori per Pro, e tutto il resto restituisce Powerhouse. Una riga economica che nessuno ha mai promosso nella lista Pro finisce quindi sul livello più alto per default, ed è per questo che il fondo della lista costi appare come una colonna Powerhouse. Il fallback stesso è documentato sulla lista modelli.
| Piano | Cosa raggiunge alla fascia economica |
|---|---|
| Free | Nessuna dotazione di crediti. Solo Whizi AI e Auto, 7 messaggi il primo giorno poi 3 al giorno |
| Starter | Quattro identificatori in totale: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Tutti costano 1 credito |
| Pro | Starter più altri 37, inclusi le righe DeepSeek, Llama, Gemini Flash, Mistral e Qwen segnate Pro sopra |
| Powerhouse | Tutto il resto del catalogo, dove si trovano le righe dei laboratori più piccoli in fondo alla lista costi |
Il piano free non è in questo confronto affatto: dal 2026-09-02 raggiunge solo Whizi AI e Auto e nient'altro, quindi né la riga più economica dell'indice né quella più costosa sono raggiungibili su di esso. Ciò che offre sono 7 messaggi il primo giorno, poi 3 al giorno, spesi su quelle due righe.
Starter è quello ristretto. Raggiunge quattro identificatori, ognuno dei quali addebita un singolo credito, e la sua dotazione di 400 crediti equivale quindi a 400 messaggi. Non c'è alcun modello Anthropic su Starter, né accesso alle righe economiche dei laboratori più piccoli nelle tabelle sopra.
Cosa compra un credito
Un credito è definito come un messaggio sul modello di casa, che gira sul modello base OpenAI fissato a un credito. Un test di build fallisce se uno dei due lascia mai quel gradino, perché spostare l'uno o l'altro ridenomina l'intera scala.
L'addebito è un intero fisso per id modello. A questo estremo del catalogo significa che una riga a 1 credito costa un credito qualunque sia la lunghezza dell'input o dell'output: incolla un documento lungo, lascia che la risposta si dilunghi, e il turno viene comunque addebitato uno.
| Riga | Costo per risposta | Costo per 1.000 risposte | Crediti |
|---|---|---|---|
| Nemotron 3.5 Lightning | $0.00018 | $0.18 | 1 |
| Llama 3.3 70B Instruct | $0.00026 | $0.26 | 1 |
| DeepSeek V4 Flash 0731 | $0.00028 | $0.28 | 1 |
| Gemini 2.5 Flash Lite | $0.0003 | $0.30 | 1 |
| DeepSeek V3.2 | $0.000469 | $0.469 | 1 |
| Llama 4 Maverick | $0.0006 | $0.60 | 1 |
| GPT-5.6 Luna | $0.0008 | $0.80 | 1 |
| Qwen3.7 Plus | $0.00096 | $0.96 | 1 |
Tradotto in dotazione, il gradino più basso è l'unico punto in cui la cifra in crediti e la cifra in messaggi coincidono: ogni turno costa uno, quindi una dotazione di piano di N crediti equivale a N messaggi finché resti su righe a 1 credito. La dotazione per piano, il reset e la regola di riporto sono tutti nel riferimento crediti.
Un altro meccanismo che conta alla fascia economica: un turno che non entra nel saldo residuo viene rifiutato per intero, non addebitato in parte. Venti crediti su tre crediti residui viene respinto, non scontato. Su un modello a 1 credito questo quasi non accade mai.
Da dove viene un gradino di credito, e quando la policy del proprietario lo sovrascrive
L'indice dei costi misura una risposta standard di 1.000 token in ingresso più 500 in uscita contro le tariffe listino dei provider. La scala dei crediti deriva da un turno di riferimento diverso, 3.000 token in ingresso e 800 in uscita, diviso per quanto costa quello stesso turno sul modello di ancoraggio, cioè $0.00156 di spesa provider. Il risultato viene poi arrotondato per eccesso a un gradino legale. La scala ne conta diciotto: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Quattordici hanno oggi almeno un modello, e i quattro vuoti sono mantenuti deliberatamente, perché un gradino mancante farebbe arrotondare il modello più costoso successivo verso quello sopra. L'arrotondamento va verso l'alto quando un modello cade tra due gradini.
Oltre a questo, alcune righe sono fissate per policy del proprietario invece che per calcolo aritmetico. Tre esempi visibili nelle tabelle sopra e nel catalogo più ampio:
- La famiglia Kimi viene addebitata 10 crediti contro tariffe reali di 2, 3, 4 e 12 a seconda della riga. Per questo due righe Moonshot si trovano quasi identiche in dollari, a $0.00172 e $0.00185, eppure addebitano entrambe 10 crediti.
- La riga Gemini su Starter viene addebitata 1 credito contro un valore reale di 2, il che è ciò che mantiene Starter a un credito piatto per messaggio.
- La riga GPT Terra viene addebitata 4 crediti contro un valore reale di 10.
Le righe con ricerca integrata sono quotate in modo ancora diverso, perché il provider addebita una tariffa fissa per ricerca che non scala con la tariffa per token. Una ricerca a $0.005 vale 3,2 crediti, quindi una singola ricerca costa più di un intero messaggio sulla maggior parte del catalogo. Quei gradini sono soglie minime che presumono una ricerca per risposta.
Un identificatore di modello senza alcun gradino viene addebitato al massimo della scala, 100 crediti, deliberatamente: un modello senza prezzo dovrebbe emergere come ticket di supporto invece che erodere silenziosamente il margine. Un test di build fallisce se un modello del catalogo o un identificatore agente arriva in produzione senza un gradino.
Infine, il prezzo in crediti è abilitato per piattaforma. Una piattaforma nella allowlist vede i moltiplicatori reali nel selettore e viene addebitata di conseguenza sulla dotazione di crediti. Una piattaforma che non c'è vede un credito piatto a turno e mantiene invece la vecchia dotazione a messaggi, che è 400 messaggi al mese su Starter, 800 su Pro e 5.000 su Powerhouse. Il client web è oggi sul sistema a crediti.
- La riga più economica dell'indice risponde una volta per $0.000053
- Una risposta standard è 1.000 token in ingresso più 500 in uscita, quotati sulle tariffe listino OpenRouter del 2026-08-20
- Ogni addebito ha un minimo di un credito, quindi nessun messaggio costa meno di uno
- La maggior parte delle righe più economiche in assoluto è su Powerhouse, perché tutto ciò che non è nella lista Starter o Pro ricade sul livello più alto
- Starter raggiunge quattro identificatori e tutti costano 1 credito, quindi 400 crediti equivalgono a 400 messaggi
- Gli account free non hanno dotazione di crediti e raggiungono due righe: Whizi AI e Auto
- Il gradino di credito deriva da un turno di riferimento diverso da quello dell'indice, e alcuni gradini sono fissati per policy
Domande frequenti
Qual è il modello AI più economico su Whizi?
Per costo per risposta standard, la riga più economica dell'indice dei costi Whizi è Ling di inclusionAI a $0.000053, seguita da Nex di Nex Agi, Solar Pro di Upstage e il livello veloce di Qwen. Tutte addebitano un credito a messaggio. Per quanto effettivamente paghi, sono a pari merito con ogni altra riga a un credito, incluso il modello di casa Whizi, il modello base GPT su Starter e diverse righe DeepSeek, Llama e Gemini.
Di quale piano ho bisogno per raggiungere i modelli più economici?
Dipende dalla riga. Diverse delle righe più economiche in assoluto richiedono Powerhouse, perché l'accesso ai modelli ricade sul livello più alto per qualsiasi identificatore che non sia nella lista Starter a quattro voci o nella lista Pro a 37 voci. Le righe economiche raggiungibili su Pro includono le voci DeepSeek, Llama, Mistral, Qwen e Gemini Flash segnate Pro nelle tabelle di questa pagina.
Un modello più economico costa sempre meno crediti?
No. Le due cifre sono misurate in modo diverso. L'indice quota una risposta standard 1.000 in ingresso, 500 in uscita contro le tariffe listino dei provider, mentre il gradino di credito viene da un turno di riferimento 3.000 in ingresso, 800 in uscita arrotondato per eccesso a un gradino legale su una scala fissa, con alcune righe fissate per policy sopra o sotto il loro valore aritmetico. Per questo una riga a $0.0015 per risposta può addebitare un credito mentre una riga a $0.000825 ne addebita due.
Cosa succede al credito se una risposta fallisce a metà?
Torna indietro. Una generazione che fallisce o viene interrotta viene rimborsata cancellando la sua riga di utilizzo, così il saldo torna dov'era. Il rimborso è associato a un id di richiesta generato dal server e non a qualcosa fornito dal client, quindi applicare lo stesso rimborso due volte restituisce esattamente un turno e non due. Una cosa che non viene rimborsata: un turno respinto per quota esaurita spende comunque i suoi token di rate limit, altrimenti un client senza crediti potrebbe riprovare senza limiti.
Posso provare i modelli economici senza abbonamento?
Non con un account free, che raggiunge solo Whizi AI e Auto. La sua dotazione è 7 messaggi il primo giorno, poi 3 al giorno, spesi su quelle due righe, e il claim di un account ospite porta il suo utilizzo nell'account registrato, quindi iniziare come ospite e registrarsi dopo non restituisce un giorno nuovo.