Det korta svaret
Ja, Whizi har Metas Llama-familj i sin katalog med 280+ modeller, och alla tre Llama-rader i Pro-uppsättningen ligger på den billigaste nivån Whizi mäter: 1 kredit per meddelande. Llama finns på Pro-planen, som kostar $29.99/month, eller $19.99/mo vid årlig betalning på $239.88. Starter innehåller ingen Llama-modell.
Llama-raderna Whizi prissätter, med kreditkostnaden per meddelande:
| Modell | Kontextfönster | Kostnad per standardsvar | Krediter per meddelande | Lägsta plan |
|---|---|---|---|---|
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Scout | Ingår inte i kostnadsindexet | Ingår inte i kostnadsindexet | 1 | Pro |
Ett standardsvar är 1 000 intoken plus 500 uttoken, prissatt utifrån priser avlästa 2026-08-20, så siffrorna går att jämföra lika mot lika mellan leverantörer.
De tre identifierarna är de Llama-rader som namnges i Pro-modelluppsättningen. Varje annan Llama-identifierare katalogen bär faller till Powerhouse-fallbacken som beskrivs nedan, så se tabellen som Pro-listan snarare än en fullständig katalogförteckning.
Vad ett Llama-meddelande kostar i krediter
Alla tre Llama-rader i Pro-uppsättningen ligger på den lägsta nivån av kreditskalan, så en Llama-tur kostar 1 kredit oavsett vad du skickar. Den tredje identifieraren, Llama 4 Scout, ingår inte i kostnadsindexet, så tabellen anger inget fönster eller pris per svar för den, men kredittabellen tar 1 kredit för den precis som för de andra två.
Vid 1 kredit per meddelande är kredittillgången samma som antalet Llama-meddelanden: på webben ger Pro 2 000 Llama-turer per månad och Powerhouse ger 8 000. Starter når ingen Llama-rad alls.
| Plan | Krediter per månad (webb) | Meddelanden per månad utanför kreditlistan |
|---|---|---|
| Starter | 600 | 600 |
| Pro | 2 000 | 800 |
| Powerhouse | 8 000 | 5 000 |
Veckobetalning erbjuds endast i mobilappen, och inte på alla nivåer. Där den säljs är de veckovisa kredittillgångarna 100 på Starter och 500 på Pro, och de veckovisa meddelandetillgångarna är 100 och 400.
En tur debiteras på nivån för den modell som svarade, så en konversation som rör sig mellan familjer debiteras per tur till varje svarande modells pris. Krediter rullar inte över: saldot summerar användning inom aktuell periodnyckel, så att en ny period börjar är i sig återställningen. Det finns ingen påfyllningsväg.
Kreditmultiplikatorer tas bara ut på plattformar i kreditlistan, som idag är webbappen. En plattform utanför listan ser en flat multiplikator på 1x, debiteras en per tur, och behåller den äldre meddelandetillgången istället. På Starter är de två tillgångarna samma siffra, 400. På Pro och Powerhouse är de inte det, vilket är kolumn två och tre i tabellen ovan.
Hela skalan, alla fjorton belagda nivåer, finns i kreditreferensen.
Plankravet, exakt
Åtkomst avgörs serversidan per identifierare (se modellreferensen).
Starter når exakt fyra alternativ i väljaren: Auto, Whizi AI, en OpenAI-modell och en Google-modell. Ingen Llama-rad finns bland dem.
Pro lägger till Llama-uppsättningen ovanpå Starter. Läst som kurationsregeln tillämpad på en familj är den uppsättningen de nuvarande Llama 4-raderna plus den äldre Llama 3-arbetshästen, tre identifierare totalt.
Powerhouse innehåller allt Pro når, eftersom nivåjämförelsen görs med ett större än eller lika med-test, så en högre nivå uppfyller alltid ett lägre krav. Powerhouse är också där varje katalogidentifierare hamnar som inte namnges i Starter- eller Pro-uppsättningarna, vilket är varför en olistad Llama-identifierare är Powerhouse tills den medvetet befordras.
Att välja en modell över din nivå ger HTTP 403 med koden tier_upgrade_required och meddelandet "Upgrade your plan to use this model." Det symptomet tas upp i när en modell inte är tillgänglig.
Gratiskonton når ingen Llama-rad: sedan 2026-09-02 öppnar gratisnivån Whizi AI och Auto och inget annat. Den fria kredittillgången är 0, och meddelandetillgången är 7 meddelanden första dagen, sedan 3 per dag, spenderade på dessa två rader.
Kontextfönster jämfört med vad en tur faktiskt får
Kontextfönstret i tabellen ovan är modellens publicerade fönster. Det är inte budgeten en enskild Whizi-tur körs med.
Varje modell i katalogen får en fast budget på 40 000 intoken och 20 000 uttoken per tur. En modell vars fönster ligger under 93 000 token får istället en mindre proportionell budget, med utdata begränsad till 40 procent av fönstret och en säkerhetsmarginal på 1 000 token hållen tillbaka.
Eftersom båda prissatta Llama-rader ligger över tröskeln på 93 000 token körs båda på samma fasta budget på 40 000 in och 20 000 ut. Det större publicerade fönstret höjer inte vad en enskild Whizi-tur skickar, och leverantören räknar begärd maximal utdata mot fönstret precis som indata, så 1M-raden och 131K-raden är dimensionerade identiskt här. Om en tråd växer ur budgeten, se när en konversation är för lång.
Var dessa rader ligger i kostnadsindexet
Kostnadsindexet prissätter 100 rader från 29 leverantörer vid ett standardsvar var. Den siffran är storleken på prisindexet, inte storleken på Whizis katalog.
| Referenspunkt | Kostnad per standardsvar |
|---|---|
| Billigaste prissatta raden i indexet | $0.000053 |
| Mediana prissatta raden | $0.00185 |
| Llama 3.3 70B Instruct | $0.00026 |
| Llama 4 Maverick | $0.0006 |
| Dyraste prissatta raden i indexet | $0.105 |
Båda prissatta Llama-rader hamnar under indexmedianen, och spannet mellan billigaste och dyraste prissatta rad är ungefär 2000x. 89 av de 100 prissatta raderna bär en Whizi-kreditkostnad, resten är prissatta för jämförelse men erbjuds inte som egna mätta rader.
Vad Llama inte används till i Whizi
Ingen Llama-rad finns på Auto-stegen. Auto har sex steg, och modellerna på dem är hushållsmodellen för korta frågor, en Gemini Flash-rad för omskrivningar och igen för bilagor, en GPT-rad för långa texter, en Claude Sonnet-rad för kod och en andra GPT-rad för flerstegsresonemang. Ingen Llama-identifierare finns på något av de sex, så Auto kan aldrig nå Llama på någon nivå, och ett Llama-svar är alltid ett manuellt val i modellväljaren.
Bilagor på Auto går någon annanstans. Auto dirigerar varje tur med en bilaga till Gemini Flash, med resonemanget att en bild behöver synförmåga snarare än ett stort fönster. Väljer du en Llama-rad själv hanteras bilagan per förfrågan snarare än per modell. I appen skickas den vidare till vilken modell turen befinner sig på, och bara det senaste användarmeddelandet som bär bilagor skickas vidare. På webben extraheras texten ur en PDF-, Word- eller kalkylarksfil i webbläsaren, och det är texten som når modellen.
Röst och mediegenerering är inte val per modell. Mediegeneratorer hoppar helt över gränsen per modell och nivåindelas istället per avsnitt i väljaren, och röstläge körs på sin egen realtidsroute, så att välja en Llama-rad ändrar inget av detta.
Whizi publicerar inget stöd för synförmåga per modell. Det finns ingen flagga för syn eller multimodalitet någonstans i katalogen eller kostnadsindexet, så Whizi kan inte tala om för dig vilken Llama-rad som läser en bild. Bilddelar skickas vidare till vilken modell turen befinner sig på, och resultatet är mellan dig och modellen.
- Llama finns i katalogen och alla tre rader i Pro-uppsättningen kostar 1 kredit per meddelande
- Pro är planen som låser upp Llama-uppsättningen, och Powerhouse innehåller den
- Starter innehåller ingen Llama-modell
- Ett gratiskonto når ingen Llama-rad: Pro är den lägsta planen som gör det
- En Llama-tur körs på den fasta budgeten 40 000 in och 20 000 ut, eftersom båda prissatta rader ligger över tröskeln på 93 000 token
- Ingen Llama-rad finns på något av de sex Auto-stegen, så Llama är alltid ett manuellt val
- Whizi publicerar ingen flagga för syn per modell, så vilken Llama-rad som läser en bild kan Whizi inte tala om
Vanliga frågor
Vilka Llama-modeller har Whizi?
Pro-modelluppsättningen namnger tre Llama-identifierare: de två Llama 4-varianterna plus Llama 3-arbetshästen, och alla tre kostar 1 kredit per meddelande. Två av dem är prissatta i Whizis kostnadsindex, med publicerade kontextfönster på 1M och 131K. Katalogen kan bära fler Llama-identifierare, och allt som inte namnges i Starter- eller Pro-uppsättningarna kräver Powerhouse.
Hur många krediter kostar ett Llama-meddelande?
En kredit, vilket är den lägsta nivån på skalan och samma som ett meddelande på Whizis hushållsmodell. Varken Starter eller gratis öppnar någon Llama-rad alls, så Pro är den första planen där den kreditsatsen köper något här.
Behöver jag den högsta planen för att använda Llama?
Nej. Pro är den billigaste planen som öppnar en Llama-rad, för $29.99/month. Starter når ingen, Powerhouse behövs bara för en Llama-identifierare som Pro-uppsättningen inte namnger, och ett gratiskonto når ingen av dem: det kör Whizi AI och Auto.
Kan jag byta en konversation från Llama till en annan modell?
Ja. Varje tur debiteras på nivån för den modell som svarade, så en tråd som rör sig mellan familjer debiteras per tur till varje pris snarare än på trådnivå. En modell lämnar aldrig katalogen när den väl erbjudits, eftersom en konversation bär den modell den skapades med, så en gammal Llama-tråd öppnas fortfarande senare. Mekaniken finns i byta modell mitt i en konversation.
Vad kan jag bifoga till en Llama-tur?
Bilagor hanteras per förfrågan snarare än per modell, och de kostar inga egna krediter. På webbplatsen kan en fil vara upp till 100 MB och ett meddelande bär upp till 6 filer. I iOS-appen är gränserna 10 MB per fil, 4 bilagor per prompt och 20 MB totalt per prompt, och de godkända typerna där är JPEG, PNG, WebP, GIF, PDF, ren text, Markdown, CSV och JSON.
Fungerar webbsökning med Llama?
Whizi publicerar ingen lista för webbsökning per modell. Sökning är en växel per förfrågan med tre lägen, av, sondera och native, snarare än en förmåga per modell, och matrisen per modell har aldrig förtecknats, så det finns inget Llama-specifikt svar att ge. Växeln själv tas upp i webbsökning.