Llama în Whizi: modele, cost în credite și plan

Răspuns rapid

Whizi include familia Meta Llama în catalogul său, iar toate cele trei rânduri Llama din setul Pro costă 1 credit per mesaj. Pro este planul care deblochează setul Llama, iar Powerhouse îl include. Starter nu include niciun model Llama. Orice identificator Llama care nu apare în setul Pro se rezolvă către Powerhouse.

Răspunsul scurt

Da, Whizi include familia Llama a Meta în catalogul său de peste 280 de modele, iar toate cele trei rânduri Llama din setul Pro stau pe cea mai ieftină treaptă măsurată de Whizi: 1 credit pe mesaj. Llama se află pe planul Pro, care costă $29.99/lună, sau $19.99/lună facturat anual la $239.88. Starter nu include niciun model Llama.

Rândurile Llama prețuite de Whizi, cu costul în credite taxat per mesaj:

ModelFereastră de contextCost per răspuns standardCredite per mesajPlan minim
Llama 4 Maverick1M$0.00061Pro
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 ScoutNu apare în Indexul de CostNu apare în Indexul de Cost1Pro

Un răspuns standard înseamnă 1.000 de tokeni de intrare plus 500 de ieșire, prețuit după tarife citite pe 2026-08-20, astfel încât cifrele se compară echitabil între furnizori.

Acei trei identificatori sunt rândurile Llama numite în setul de modele Pro. Orice alt identificator Llama pe care catalogul îl include cade în fallback-ul Powerhouse descris mai jos, așa că tratează tabelul ca lista Pro, nu ca o enumerare completă a catalogului.

Cât costă în credite un mesaj Llama

Toate cele trei rânduri Llama din setul Pro stau pe treapta cea mai de jos a scării de credite, așa că o replică Llama costă 1 credit indiferent ce trimiți. Al treilea identificator, Llama 4 Scout, nu apare în Indexul de Cost, așa că tabelul nu publică nicio fereastră sau preț per răspuns pentru el, dar tabelul de credite îl taxează tot cu 1 credit, la fel ca celelalte două.

La 1 credit pe mesaj, alocația de credite este numărul de replici Llama: pe web, Pro cumpără 2.000 de replici Llama pe lună, iar Powerhouse cumpără 8.000. Starter nu ajunge la niciun rând Llama.

PlanCredite pe lună (web)Mesaje pe lună în afara listei de credite
Starter400400
Pro2.000800
Powerhouse8.0005.000

Facturarea săptămânală este oferită doar pe mobil, și nu la fiecare nivel. Acolo unde este vândută, alocațiile săptămânale de credite sunt 100 pe Starter și 500 pe Pro, iar alocațiile săptămânale de mesaje sunt 100 și 400.

O replică este taxată la treapta modelului care a răspuns, așa că o conversație care trece între familii este facturată per replică la rata fiecărui model care răspunde. Creditele nu se reportează: soldul însumează utilizarea în cadrul cheii perioadei curente, astfel încât apariția unei noi perioade este ea însăși reinițializarea. Nu există cale de reîncărcare.

Multiplicatorii de credite sunt taxați doar pe platformele din lista de credite, care astăzi este aplicația web. O platformă din afara acestei liste vede un multiplicator fix de 1x, este taxată câte unul pe replică, și păstrează alocația de mesaje mai veche în loc. Pe Starter cele două alocații sunt același număr, 400. Pe Pro și Powerhouse nu sunt, ceea ce reprezintă a doua și a treia coloană din tabelul de mai sus.

Scara completă, toate cele paisprezece trepte ocupate, se află în referința creditelor.

Restricția de plan, exact

Accesul este rezolvat pe server, după identificator (vezi referința modelelor).

Starter ajunge la exact patru intrări în selector: Auto, Whizi AI, un model OpenAI și un model Google. Niciun rând Llama nu se numără printre ele.

Pro adaugă setul Llama peste Starter. Citit ca regula de curatoriere aplicată unei singure familii, acel set înseamnă rândurile Llama 4 actuale plus veteranul Llama 3, trei identificatori în total.

Powerhouse include tot ce ajunge Pro, pentru că ierarhia nivelurilor se compară printr-un test mai mare sau egal, astfel încât un nivel mai înalt satisface întotdeauna o cerință mai joasă. Powerhouse este și locul unde ajunge orice identificator din catalog care nu este numit în seturile Starter sau Pro, motiv pentru care un identificator Llama nelistat este Powerhouse până este promovat deliberat.

Selectarea unui model peste nivelul tău returnează HTTP 403 cu codul tier_upgrade_required și mesajul "Upgrade your plan to use this model." Acest simptom este acoperit în când un model nu este disponibil.

Conturile gratuite nu ajung la niciun rând Llama: din 2026-09-02, nivelul gratuit deschide Whizi AI și Auto și nimic altceva. Alocația gratuită de credite este 0, iar alocația de mesaje este 7 mesaje în prima zi, apoi 3 pe zi, cheltuite pe acele două rânduri.

Fereastra de context față de ce primește efectiv o replică

Fereastra de context din tabelul de mai sus este fereastra publicată a modelului. Nu este bugetul cu care rulează o singură replică Whizi.

Fiecare model din catalog primește un buget fix de 40.000 de tokeni de intrare și 20.000 de ieșire per replică. Un model a cărui fereastră este sub 93.000 de tokeni primește în schimb un buget proporțional mai mic, cu ieșirea limitată la 40 la sută din fereastră și o marjă de siguranță de 1.000 de tokeni reținută.

Deoarece ambele rânduri Llama prețuite se află peste pragul de 93.000 de tokeni, ambele rulează pe același buget fix de 40.000 de intrare și 20.000 de ieșire. Fereastra publicată mai mare nu ridică ce trimite o singură replică Whizi, iar furnizorul contorizează ieșirea maximă cerută împotriva ferestrei la fel ca intrarea, așa că rândul de 1M și rândul de 131K sunt dimensionate identic aici. Dacă un fir de discuție depășește bugetul, vezi când o conversație este prea lungă.

Unde se situează aceste rânduri în Indexul de Cost

Indexul de Cost prețuiește 100 de rânduri la 29 de furnizori, la câte un răspuns standard fiecare. Acel număr este dimensiunea indexului de prețuri, nu dimensiunea catalogului Whizi.

Punct de referințăCost per răspuns standard
Cel mai ieftin rând prețuit din index$0.000053
Rândul median prețuit$0.00185
Llama 3.3 70B Instruct$0.00026
Llama 4 Maverick$0.0006
Cel mai scump rând prețuit din index$0.105

Ambele rânduri Llama prețuite se situează sub mediana indexului, iar diferența dintre cel mai ieftin și cel mai scump rând prețuit este de aproximativ 2000x. 89 din cele 100 de rânduri prețuite au o taxă în credite Whizi; restul sunt prețuite pentru comparație, dar nu sunt oferite ca rând propriu, măsurat separat.

Pentru ce nu este folosit Llama în Whizi

Niciun rând Llama nu se află pe scara Auto. Auto are șase trepte, iar modelele de pe ele sunt modelul casei pentru întrebări scurte, un rând Gemini Flash pentru reformulări și din nou pentru atașamente, un rând GPT pentru text lung, un rând Claude Sonnet pentru cod și un al doilea rând GPT pentru raționament în mai mulți pași. Niciun identificator Llama nu apare pe niciuna dintre cele șase, astfel încât Auto nu poate ajunge la Llama la niciun nivel, iar un răspuns Llama este întotdeauna o alegere manuală din selectorul de modele.

Atașamentele pe Auto merg în altă parte. Auto direcționează orice replică cu un atașament către Gemini Flash, pe motivul că o imagine are nevoie de vedere artificială, nu de o fereastră mare. Alege tu însuți un rând Llama, iar atașamentul este tratat per cerere, nu per model. Pe aplicație, este trimis către oricare model se află pe replica respectivă, și doar cel mai recent mesaj al utilizatorului care poartă atașamente este trimis. Pe web, un fișier PDF, Word sau de calcul tabelar are textul extras în browser, iar textul este ceea ce ajunge la model.

Vocea și generarea de media nu sunt alegeri per model. Generatoarele de media sar complet peste restricția per model și sunt organizate pe niveluri după secțiunea din selector, iar modul voce rulează pe propria rută în timp real, așa că alegerea unui rând Llama nu schimbă niciuna dintre ele.

Whizi nu publică suportul de vedere per model. Nu există niciun indicator de capacitate vizuală sau multimodală nicăieri în catalog sau în indexul de cost, așa că Whizi nu îți poate spune care rând Llama citește o imagine. Părțile de imagine sunt trimise către oricare model se află pe replică, iar rezultatul rămâne între tine și model.

Listă de verificare
  • Llama se află în catalog, iar toate cele trei rânduri din setul Pro costă 1 credit per mesaj
  • Pro este planul care deblochează setul Llama, iar Powerhouse îl include
  • Starter nu include niciun model Llama
  • Un cont gratuit nu ajunge la niciun rând Llama: Pro este cel mai jos plan care ajunge
  • O replică Llama rulează pe bugetul fix de 40.000 de intrare și 20.000 de ieșire, pentru că ambele rânduri prețuite se află peste pragul de 93.000 de tokeni
  • Niciun rând Llama nu se află pe niciuna dintre cele șase trepte Auto, așa că Llama este întotdeauna o alegere manuală
  • Whizi nu publică niciun indicator de vedere per model, așa că nu poate spune care rând Llama citește o imagine

Întrebări frecvente

Ce modele Llama include Whizi?

Setul de modele Pro numește trei identificatori Llama: cele două variante Llama 4 plus veteranul Llama 3, iar toate trei costă 1 credit per mesaj. Două dintre ele sunt prețuite în Indexul de Cost Whizi, cu ferestre de context publicate de 1M și 131K. Catalogul poate include și alți identificatori Llama, iar orice nu este numit în seturile Starter sau Pro necesită Powerhouse.

Câte credite costă un mesaj Llama?

Un credit, care este treapta cea mai de jos a scării, la fel ca un mesaj pe modelul casei Whizi. Nici Starter, nici gratuit nu deschid niciun rând Llama, așa că Pro este primul plan unde acel 1 credit cumpără ceva aici.

Am nevoie de planul cel mai scump ca să folosesc Llama?

Nu. Pro este cel mai ieftin plan care deschide un rând Llama, la $29.99/lună. Starter nu ajunge la niciunul, Powerhouse este necesar doar pentru un identificator Llama pe care setul Pro nu îl numește, iar un cont gratuit nu ajunge la niciunul dintre ele: rulează Whizi AI și Auto.

Pot schimba o conversație de la Llama la alt model?

Da. Fiecare replică este taxată la treapta modelului care a răspuns, așa că un fir care trece între familii este facturat per replică la fiecare rată, nu la nivelul întregului fir. Un model nu părăsește niciodată catalogul odată ce a fost oferit, pentru că o conversație poartă modelul cu care a fost creată, așa că un fir vechi Llama tot se deschide mai târziu. Mecanismele sunt în schimbarea modelelor în mijlocul conversației.

Ce pot atașa la o replică Llama?

Atașamentele sunt tratate per cerere, nu per model, și nu costă credite proprii. Limitele sunt 10 MB per fișier, 4 atașamente per prompt și 20 MB în total per prompt. Tipurile acceptate sunt JPEG, PNG, WebP, GIF, PDF, text simplu, Markdown, CSV și JSON.

Funcționează căutarea web cu Llama?

Whizi nu publică o listă de căutare web per model. Căutarea este un comutator per cerere cu trei moduri, dezactivat, sondaj și nativ, nu un indicator de capacitate per model, iar matricea per model nu a fost niciodată enumerată, așa că nu există un răspuns specific pentru Llama. Comutatorul în sine este acoperit în căutare web.