Krótka odpowiedź
Tak, Whizi ma w swoim katalogu ponad 280 modeli rodzinę Llama od Meta, a wszystkie trzy modele Llama w zestawie Pro znajdują się na najtańszym szczeblu, jaki Whizi mierzy: 1 kredyt za wiadomość. Llama jest dostępna w planie Pro, który kosztuje $29.99/miesiąc, albo $19.99/mies. przy rozliczeniu rocznym za $239.88. Starter nie zawiera żadnego modelu Llama.
Modele Llama wycenione przez Whizi, wraz z kosztem w kredytach naliczanym za wiadomość:
| Model | Okno kontekstu | Koszt standardowej odpowiedzi | Kredyty za wiadomość | Minimalny plan |
|---|---|---|---|---|
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Scout | Brak w Cost Index | Brak w Cost Index | 1 | Pro |
Standardowa odpowiedź to 1000 tokenów wejściowych plus 500 wyjściowych, wycenionych na podstawie stawek odczytanych 2026-08-20, dzięki czemu liczby porównują dostawców jak do jak.
Te trzy identyfikatory to modele Llama wymienione w zestawie Pro. Każdy inny identyfikator Llama dostępny w katalogu trafia do rezerwowego poziomu Powerhouse opisanego poniżej, więc traktuj tabelę jako listę Pro, a nie pełny spis katalogu.
Ile kosztuje wiadomość Llama w kredytach
Wszystkie trzy modele Llama w zestawie Pro znajdują się na najniższym szczeblu drabiny kredytowej, więc tura z Llama kosztuje 1 kredyt, niezależnie od tego, co wyślesz. Trzeci identyfikator, Llama 4 Scout, nie znajduje się w Cost Index, więc tabela nie podaje dla niego okna ani ceny za odpowiedź, ale tabela kredytów nalicza mu 1 kredyt, tak jak dwóm pozostałym.
Przy 1 kredycie za wiadomość limit kredytów to jednocześnie liczba wiadomości Llama: w wersji web Pro daje 2,000 tur Llama miesięcznie, a Powerhouse 8,000. Starter nie sięga do żadnego modelu Llama.
| Plan | Kredyty miesięcznie (web) | Wiadomości miesięcznie poza listą kredytową |
|---|---|---|
| Starter | 400 | 400 |
| Pro | 2,000 | 800 |
| Powerhouse | 8,000 | 5,000 |
Rozliczenie tygodniowe jest dostępne tylko w aplikacji mobilnej i nie na każdym poziomie. Tam, gdzie jest oferowane, tygodniowe limity kredytów to 100 w Starter i 500 w Pro, a tygodniowe limity wiadomości to 100 i 400.
Tura jest rozliczana według szczebla modelu, który na nią odpowiedział, więc rozmowa przechodząca między rodzinami jest rozliczana za każdą turę według stawki danego modelu. Kredyty nie przechodzą na kolejny okres: saldo sumuje zużycie w ramach bieżącego klucza okresu, więc nadejście nowego okresu samo w sobie jest resetem. Nie ma ścieżki doładowania.
Mnożniki kredytów są naliczane tylko na platformach z listy kredytowej, którą dziś jest aplikacja web. Platforma spoza tej listy widzi płaski mnożnik 1x, jest obciążana jeden kredyt za turę i zachowuje starszy limit wiadomości. W Starter oba limity to ta sama liczba, 400. W Pro i Powerhouse już nie, co widać w drugiej i trzeciej kolumnie tabeli powyżej.
Pełna drabina, wszystkie czternaście zajętych szczebli, znajduje się w materiale o kredytach.
Bramka planu, dokładnie
Dostęp jest ustalany po stronie serwera na podstawie identyfikatora (zobacz materiał o modelach).
Starter ma dokładnie cztery pozycje w selektorze: Auto, Whizi AI, jeden model OpenAI i jeden model Google. Nie ma wśród nich żadnego modelu Llama.
Pro dodaje zestaw Llama do tego, co ma Starter. Czytając to jako regułę kuracji zastosowaną do jednej rodziny, ten zestaw to aktualne modele Llama 4 plus starszy koń roboczy Llama 3, w sumie trzy identyfikatory.
Powerhouse obejmuje wszystko, do czego dociera Pro, ponieważ ranga poziomów jest porównywana testem większe lub równe, więc wyższy poziom zawsze spełnia niższy wymóg. Powerhouse to też miejsce, gdzie trafia każdy identyfikator z katalogu, którego nie ma w zestawach Starter ani Pro, dlatego niewymieniony identyfikator Llama należy do Powerhouse, dopóki nie zostanie celowo przeniesiony wyżej.
Wybranie modelu powyżej Twojego poziomu zwraca HTTP 403 z kodem tier_upgrade_required i komunikatem "Upgrade your plan to use this model." Ten objaw opisano w gdy model jest niedostępny.
Konta darmowe nie mają dostępu do żadnego modelu Llama: od 2026-09-02 darmowy poziom udostępnia tylko Whizi AI i Auto. Darmowy limit kredytów to 0, a limit wiadomości to 7 wiadomości pierwszego dnia, potem 3 dziennie, wydawane na te dwa modele.
Okno kontekstu a to, co faktycznie dostaje tura
Okno kontekstu w tabeli powyżej to opublikowane okno modelu. To nie jest budżet, na jakim działa pojedyncza tura w Whizi.
Każdy model w katalogu dostaje stały budżet 40,000 tokenów wejściowych i 20,000 wyjściowych na turę. Model, którego okno wynosi poniżej 93,000 tokenów, dostaje mniejszy proporcjonalny budżet, z limitem wyjścia ograniczonym do 40 procent okna i zapasem bezpieczeństwa 1,000 tokenów.
Ponieważ oba wycenione modele Llama mają okno powyżej progu 93,000 tokenów, oba działają na tym samym stałym budżecie 40,000 wejściowych i 20,000 wyjściowych. Większe opublikowane okno nie zwiększa tego, co pojedyncza tura w Whizi wysyła, a dostawca liczy żądane maksymalne wyjście zarówno do okna, jak i do wejścia, więc model z oknem 1M i model z oknem 131K mają tu identyczny rozmiar. Jeśli wątek przerośnie budżet, zobacz gdy rozmowa jest za długa.
Gdzie te modele plasują się w Cost Index
Cost Index wycenia 100 modeli od 29 dostawców, każdy przy jednej standardowej odpowiedzi. Ta liczba to rozmiar indeksu cenowego, nie rozmiar katalogu Whizi.
| Punkt odniesienia | Koszt standardowej odpowiedzi |
|---|---|
| Najtańszy wyceniony model w indeksie | $0.000053 |
| Mediana wycenionych modeli | $0.00185 |
| Llama 3.3 70B Instruct | $0.00026 |
| Llama 4 Maverick | $0.0006 |
| Najdroższy wyceniony model w indeksie | $0.105 |
Oba wycenione modele Llama plasują się poniżej mediany indeksu, a rozstęp między najtańszym a najdroższym wycenionym modelem sięga około 2000x. 89 ze 100 wycenionych modeli ma naliczaną opłatę w kredytach Whizi, reszta jest wyceniona do porównania, ale nie jest oferowana jako osobny mierzony model.
Do czego Llama nie jest używana w Whizi
Żaden model Llama nie znajduje się na drabinie Auto. Auto ma sześć szczebli, a modele na nich to model domowy do krótkich pytań, model Gemini Flash do przeróbek i ponownie do załączników, model GPT do dłuższych form, model Claude Sonnet do kodu i drugi model GPT do wieloetapowego rozumowania. Żaden identyfikator Llama nie pojawia się na żadnym z sześciu, więc Auto nigdy nie sięga do Llama na żadnym poziomie, a odpowiedź Llama zawsze wymaga ręcznego wyboru w selektorze modeli.
Załączniki w Auto trafiają gdzie indziej. Auto kieruje każdą turę z załącznikiem do Gemini Flash, bo obraz wymaga widzenia, a nie dużego okna. Jeśli sam wybierzesz model Llama, załącznik jest obsługiwany per żądanie, a nie per model. W aplikacji jest przekazywany do modelu, na którym aktualnie jest tura, i tylko najnowsza wiadomość użytkownika z załącznikami jest przekazywana. W wersji web plik PDF, Word czy arkusz kalkulacyjny ma tekst wyodrębniany w przeglądarce, i to ten tekst trafia do modelu.
Głos i generowanie mediów nie są wyborem per model. Generatory mediów całkowicie pomijają bramkę per model i są rozdzielone według sekcji selektora, a tryb głosowy działa na własnej trasie czasu rzeczywistego, więc wybór modelu Llama nie zmienia żadnego z nich.
Whizi nie publikuje obsługi wizji per model. W katalogu ani w indeksie kosztów nie ma żadnej flagi możliwości wizji czy multimodalności, więc Whizi nie może powiedzieć, który model Llama odczytuje obraz. Części z obrazem są przekazywane do modelu, na którym aktualnie jest tura, a wynik zależy od Ciebie i modelu.
- Llama jest w katalogu, a wszystkie trzy modele w zestawie Pro kosztują 1 kredyt za wiadomość
- Pro to plan, który odblokowuje zestaw Llama, a Powerhouse go zawiera
- Starter nie zawiera żadnego modelu Llama
- Darmowe konto nie ma dostępu do żadnego modelu Llama: Pro to najniższy plan, który go daje
- Tura z Llama działa na stałym budżecie 40,000 tokenów wejściowych i 20,000 wyjściowych, ponieważ oba wycenione modele mają okno powyżej progu 93,000 tokenów
- Żaden model Llama nie znajduje się na żadnym z sześciu szczebli Auto, więc Llama zawsze wymaga ręcznego wyboru
- Whizi nie publikuje flagi wizji per model, więc nie może powiedzieć, który model Llama odczytuje obraz
Najczęstsze pytania
Które modele Llama oferuje Whizi?
Zestaw Pro wymienia trzy identyfikatory Llama: dwa warianty Llama 4 plus konia roboczego Llama 3, i wszystkie trzy kosztują 1 kredyt za wiadomość. Dwa z nich są wycenione w Cost Index Whizi, z opublikowanymi oknami kontekstu 1M i 131K. Katalog może zawierać dalsze identyfikatory Llama, a każdy, którego nie ma w zestawach Starter ani Pro, wymaga Powerhouse.
Ile kredytów kosztuje wiadomość Llama?
Jeden kredyt, czyli najniższy szczebel drabiny, tyle samo co jedna wiadomość na domowym modelu Whizi. Ani Starter, ani darmowe konto nie udostępniają żadnego modelu Llama, więc Pro to pierwszy plan, w którym ten 1 kredyt cokolwiek tu kupuje.
Czy potrzebuję najwyższego planu, żeby używać Llama?
Nie. Pro to najtańszy plan, który udostępnia model Llama, za $29.99/miesiąc. Starter do żadnego nie sięga, Powerhouse jest potrzebny tylko dla identyfikatora Llama, którego nie ma w zestawie Pro, a darmowe konto nie ma dostępu do żadnego z nich: działa na Whizi AI i Auto.
Czy mogę przełączyć rozmowę z Llama na inny model?
Tak. Każda tura jest rozliczana według szczebla modelu, który na nią odpowiedział, więc wątek przechodzący między rodzinami jest rozliczany za każdą turę według danej stawki, a nie na poziomie całego wątku. Model nigdy nie znika z katalogu, gdy już został zaoferowany, ponieważ rozmowa nosi model, z którym została utworzona, więc stary wątek Llama nadal się otwiera. Mechanika jest opisana w przełączaniu modeli w trakcie rozmowy.
Co mogę załączyć do tury z Llama?
Załączniki są obsługiwane per żądanie, a nie per model, i same w sobie nie kosztują kredytów. Limity to 10 MB na plik, 4 załączniki na wiadomość i 20 MB łącznie na wiadomość. Akceptowane typy to JPEG, PNG, WebP, GIF, PDF, zwykły tekst, Markdown, CSV i JSON.
Czy wyszukiwanie w sieci działa z Llama?
Whizi nie publikuje listy wyszukiwania w sieci per model. Wyszukiwanie to przełącznik per żądanie z trzema trybami: off, probe i native, a nie flaga możliwości per model, i macierz per model nigdy nie została opublikowana, więc nie ma odpowiedzi specyficznej dla Llama. Sam przełącznik jest opisany w wyszukiwaniu w sieci.