Het korte antwoord
Ja, Whizi neemt Meta's Llama-familie op binnen zijn catalogus van 280+ modellen, en alle drie de Llama-rijen in de Pro-set zitten op de goedkoopste trede die Whizi meet: 1 credit per bericht. Llama zit op het Pro-abonnement, dat $29.99/maand kost, of $19.99/mo bij jaarlijkse facturering van $239.88. Starter bevat geen enkel Llama-model.
De Llama-rijen die Whizi prijst, met de creditkosten per bericht:
| Model | Contextvenster | Kosten per standaardantwoord | Credits per bericht | Minimaal abonnement |
|---|---|---|---|---|
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Scout | Niet opgenomen in de Cost Index | Niet opgenomen in de Cost Index | 1 | Pro |
Een standaardantwoord is 1.000 inputtokens plus 500 outputtokens, geprijsd op basis van tarieven gelezen op 2026-08-20, zodat de cijfers appels met appels vergelijken tussen providers.
Die drie identifiers zijn de Llama-rijen die in de Pro-modelset worden genoemd. Elke andere Llama-identifier die de catalogus bevat, valt terug op de Powerhouse-fallback die hieronder wordt beschreven, dus zie de tabel als de Pro-lijst en niet als een volledige catalogusopsomming.
Wat een Llama-bericht kost in credits
Alle drie de Llama-rijen in de Pro-set zitten op de onderste trede van de creditladder, dus een Llama-beurt kost 1 credit ongeacht wat je verstuurt. De derde identifier, Llama 4 Scout, is niet opgenomen in de Cost Index, dus de tabel publiceert geen venster of prijs per antwoord ervoor, maar de credittabel rekent er wel 1 credit voor aan, net als bij de andere twee.
Bij 1 credit per bericht is de creditlimiet het aantal Llama-berichten: op het web koopt Pro 2.000 Llama-beurten per maand en Powerhouse 8.000. Starter bereikt geen enkele Llama-rij.
| Abonnement | Credits per maand (web) | Berichten per maand buiten de creditallowlist |
|---|---|---|
| Starter | 400 | 400 |
| Pro | 2.000 | 800 |
| Powerhouse | 8.000 | 5.000 |
Wekelijkse facturering wordt alleen op mobiel aangeboden, en niet op elk niveau. Waar het wordt verkocht, zijn de wekelijkse creditlimieten 100 op Starter en 500 op Pro, en de wekelijkse berichtenlimieten zijn 100 en 400.
Een beurt wordt in rekening gebracht op de trede van het model dat antwoordde, dus een gesprek dat tussen families wisselt, wordt per beurt gefactureerd tegen het tarief van elk antwoordend model. Credits worden niet overgedragen: het saldo telt gebruik op binnen de huidige periodesleutel, dus de komst van een nieuwe periode is zelf de reset. Er is geen manier om bij te vullen.
Creditvermenigvuldigers worden alleen in rekening gebracht op platforms in de creditallowlist, wat vandaag de webapp is. Een platform buiten de allowlist ziet een vlakke 1x, wordt per beurt met één belast, en behoudt de oudere berichtenlimiet in plaats daarvan. Op Starter zijn de twee limieten hetzelfde getal, 400. Op Pro en Powerhouse zijn dat niet, wat de tweede en derde kolom van bovenstaande tabel is.
De volledige ladder, alle veertien bezette treden, staat in het creditsoverzicht.
De abonnementsgrens, precies
Toegang wordt server side per identifier bepaald (zie het modellenoverzicht).
Starter bereikt precies vier keuzeopties: Auto, Whizi AI, een OpenAI-model en een Google-model. Geen enkele Llama-rij zit daarbij.
Pro voegt de Llama-set toe boven op Starter. Gelezen als de curatieregel toegepast op één familie, bestaat die set uit de huidige Llama 4-rijen plus het oudere Llama 3-werkpaard, drie identifiers in totaal.
Powerhouse bevat alles wat Pro bereikt, omdat de niveaus worden vergeleken met een groter-dan-of-gelijk-aan-test, dus een hoger niveau voldoet altijd aan een lagere eis. Powerhouse is ook waar elke catalogusidentifier terechtkomt die niet in de Starter- of Pro-sets wordt genoemd, wat is waarom een niet-vermelde Llama-identifier Powerhouse is totdat hij bewust wordt gepromoveerd.
Het selecteren van een model boven je niveau geeft HTTP 403 terug met de code tier_upgrade_required en het bericht "Upgrade your plan to use this model." Dat symptoom wordt behandeld in wanneer een model niet beschikbaar is.
Gratis accounts bereiken geen enkele Llama-rij: sinds 2026-09-02 opent het gratis niveau Whizi AI en Auto en niets anders. De gratis creditlimiet is 0, en de berichtenlimiet is 7 berichten op de eerste dag, daarna 3 per dag, besteed aan die twee rijen.
Contextvenster versus wat een beurt werkelijk krijgt
Het contextvenster in de tabel hierboven is het gepubliceerde venster van het model. Het is niet het budget waarmee een enkele Whizi-beurt draait.
Elk model in de catalogus krijgt een vast budget van 40.000 inputtokens en 20.000 outputtokens per beurt. Een model met een venster onder 93.000 tokens krijgt in plaats daarvan een kleiner, proportioneel budget, waarbij de output wordt begrensd op 40 procent van het venster en 1.000 tokens als veiligheidsmarge worden achtergehouden.
Omdat beide geprijsde Llama-rijen boven de drempel van 93.000 tokens zitten, draaien beide op hetzelfde vaste budget van 40.000 input en 20.000 output. Het grotere gepubliceerde venster verhoogt niet wat een enkele Whizi-beurt verstuurt, en de provider telt de gevraagde maximale output ook mee tegen het venster naast de input, dus de rij van 1M en de rij van 131K zijn hier identiek qua omvang. Als een gesprek het budget overstijgt, zie wanneer een gesprek te lang is.
Waar deze rijen staan in de Cost Index
De Cost Index prijst 100 rijen over 29 providers bij één standaardantwoord elk. Dat aantal is de omvang van de prijsindex, niet de omvang van de Whizi-catalogus.
| Referentiepunt | Kosten per standaardantwoord |
|---|---|
| Goedkoopste geprijsde rij in de index | $0.000053 |
| Mediaan geprijsde rij | $0.00185 |
| Llama 3.3 70B Instruct | $0.00026 |
| Llama 4 Maverick | $0.0006 |
| Duurste geprijsde rij in de index | $0.105 |
Beide geprijsde Llama-rijen landen onder de mediaan van de index, en de spreiding tussen de goedkoopste en duurste geprijsde rij is ruwweg 2000x. 89 van de 100 geprijsde rijen dragen een Whizi-creditkosten; de rest is geprijsd ter vergelijking maar wordt niet aangeboden als eigen gemeten rij.
Waarvoor Llama niet wordt gebruikt in Whizi
Geen enkele Llama-rij zit op de Auto-ladder. Auto heeft zes treden, en de modellen daarop zijn het huismodel voor korte vragen, een Gemini Flash-rij voor herschrijvingen en nogmaals voor bijlagen, een GPT-rij voor lange vorm, een Claude Sonnet-rij voor code en een tweede GPT-rij voor meerstaps redeneren. Geen enkele Llama-identifier verschijnt op een van de zes, dus Auto kan Llama op geen enkel niveau bereiken en een Llama-antwoord is altijd een handmatige keuze in de modelkiezer.
Bijlagen op Auto gaan elders naartoe. Auto stuurt elke beurt met een bijlage naar Gemini Flash, met de redenering dat een afbeelding visie nodig heeft in plaats van een groot venster. Selecteer zelf een Llama-rij en de bijlage wordt per verzoek behandeld in plaats van per model. In de app wordt het doorgestuurd naar welk model de beurt ook draait, en alleen het meest recente gebruikersbericht met bijlagen wordt doorgestuurd. Op het web wordt de tekst van een PDF-, Word- of spreadsheetbestand in de browser geëxtraheerd, en die tekst is wat het model bereikt.
Spraak en mediageneratie zijn geen keuzes per model. Mediagenerators slaan de per-model-grens volledig over en worden in plaats daarvan getrapt per keuzemenu-sectie, en spraakmodus draait op zijn eigen realtimeroute, dus het kiezen van een Llama-rij verandert geen van beide.
Whizi publiceert geen visieondersteuning per model. Er is nergens in de catalogus of de cost index een vlag voor visie- of multimodale capaciteit, dus Whizi kan je niet vertellen welke Llama-rij een afbeelding leest. Beeldonderdelen worden doorgestuurd naar welk model de beurt ook draait en het resultaat is tussen jou en het model.
- Llama zit in de catalogus en alle drie de rijen in de Pro-set kosten 1 credit per bericht
- Pro is het abonnement dat de Llama-set ontgrendelt, en Powerhouse bevat het
- Starter bevat geen enkel Llama-model
- Een gratis account bereikt geen enkele Llama-rij: Pro is het laagste abonnement dat dit doet
- Een Llama-beurt draait op het vaste budget van 40.000 input- en 20.000 outputtokens, omdat beide geprijsde rijen boven de drempel van 93.000 tokens zitten
- Geen enkele Llama-rij zit op een van de zes Auto-treden, dus Llama is altijd een handmatige keuze
- Whizi publiceert geen visievlag per model, dus welke Llama-rij een afbeelding leest kan het niet zeggen
Veelgestelde vragen
Welke Llama-modellen bevat Whizi?
De Pro-modelset noemt drie Llama-identifiers: de twee Llama 4-varianten plus het Llama 3-werkpaard, en alle drie kosten 1 credit per bericht. Twee ervan zijn geprijsd in de Whizi Cost Index, met gepubliceerde contextvensters van 1M en 131K. De catalogus kan verdere Llama-identifiers bevatten, en alles wat niet in de Starter- of Pro-sets wordt genoemd, vereist Powerhouse.
Hoeveel credits kost een Llama-bericht?
Eén credit, wat de onderste trede van de ladder is en hetzelfde als één bericht op het Whizi-huismodel. Noch Starter noch gratis opent ook maar een Llama-rij, dus Pro is het eerste abonnement waar die ene credit hier iets koopt.
Heb ik het topabonnement nodig om Llama te gebruiken?
Nee. Pro is het goedkoopste abonnement dat een Llama-rij opent, voor $29.99/maand. Starter bereikt er geen, Powerhouse is alleen nodig voor een Llama-identifier die de Pro-set niet noemt, en een gratis account bereikt geen van beide: het draait Whizi AI en Auto.
Kan ik een gesprek van Llama naar een ander model overzetten?
Ja. Elke beurt wordt in rekening gebracht op de trede van het model dat antwoordde, dus een gesprek dat tussen families wisselt, wordt per beurt gefactureerd tegen elk tarief in plaats van op gespreksniveau. Een model verlaat de catalogus nooit zodra het is aangeboden, omdat een gesprek het model behoudt waarmee het is aangemaakt, dus een oude Llama-thread opent later nog steeds. De mechanica staat in modellen wisselen tijdens een gesprek.
Wat kan ik bijvoegen bij een Llama-beurt?
Bijlagen worden per verzoek behandeld in plaats van per model, en ze kosten zelf geen credits. De limieten zijn 10 MB per bestand, 4 bijlagen per prompt en 20 MB in totaal per prompt. De geaccepteerde types zijn JPEG, PNG, WebP, GIF, PDF, platte tekst, Markdown, CSV en JSON.
Werkt websearch met Llama?
Whizi publiceert geen websearchlijst per model. Search is een schakelaar per verzoek met drie modi, uit, probe en native, in plaats van een capaciteitsvlag per model, en de matrix per model is nooit opgesomd, dus er is geen Llama-specifiek antwoord te geven. De schakelaar zelf wordt behandeld in websearch.