Llama in Whizi nutzen: Modelle, Credit-Kosten und Plan

Kurzantwort

Whizi führt die Meta Llama Familie in seinem Katalog, und alle drei Llama Modelle im Pro Set kosten 1 Credit pro Nachricht. Pro ist der Plan, der das Llama Set freischaltet, und Powerhouse enthält es ebenfalls. Starter enthält kein Llama Modell. Jede Llama Kennung, die das Pro Set nicht nennt, fällt auf Powerhouse zurück.

Die kurze Antwort

Ja, Whizi führt Metas Llama Familie in seinem Katalog von über 280 Modellen, und alle drei Llama Modelle im Pro Set liegen auf der günstigsten Stufe, die Whizi misst: 1 Credit pro Nachricht. Llama liegt beim Pro Plan, der $29.99/Monat kostet, oder $19.99/Monat bei jährlicher Abrechnung mit $239.88. Starter enthält kein Llama Modell.

Die Llama Modelle, die Whizi bepreist, mit den Credit-Kosten pro Nachricht:

ModellKontextfensterKosten pro StandardantwortCredits pro NachrichtMindestplan
Llama 4 Maverick1M$0.00061Pro
Llama 3.3 70B Instruct131K$0.000261Pro
Llama 4 ScoutNicht im Cost Index geführtNicht im Cost Index geführt1Pro

Eine Standardantwort besteht aus 1.000 Input-Token plus 500 Output-Token, bepreist nach Sätzen, die am 2026-08-20 erhoben wurden, sodass die Zahlen anbieterübergreifend vergleichbar sind.

Diese drei Kennungen sind die Llama Modelle, die im Pro Modell-Set genannt werden. Jede weitere Llama Kennung im Katalog fällt auf den unten beschriebenen Powerhouse-Fallback zurück, also ist die Tabelle als Pro Liste zu lesen, nicht als vollständige Katalogaufzählung.

Was eine Llama Nachricht an Credits kostet

Alle drei Llama Modelle im Pro Set liegen auf der untersten Stufe der Credit-Leiter, sodass ein Llama Turn 1 Credit kostet, egal was gesendet wird. Die dritte Kennung, Llama 4 Scout, wird nicht im Cost Index geführt, sodass die Tabelle dafür kein Fenster oder keinen Preis pro Antwort ausweist, aber die Credit-Tabelle berechnet dafür wie bei den anderen beiden 1 Credit.

Bei 1 Credit pro Nachricht entspricht das Credit-Kontingent der Anzahl möglicher Llama Nachrichten: Im Web kauft Pro 2.000 Llama Turns pro Monat und Powerhouse 8.000. Starter erreicht überhaupt kein Llama Modell.

PlanCredits pro Monat (Web)Nachrichten pro Monat außerhalb der Credit-Allowlist
Starter400400
Pro2.000800
Powerhouse8.0005.000

Wöchentliche Abrechnung wird nur auf Mobilgeräten angeboten, und nicht auf jeder Stufe. Wo sie verkauft wird, liegen die wöchentlichen Credit-Kontingente bei 100 auf Starter und 500 auf Pro, und die wöchentlichen Nachrichtenkontingente bei 100 und 400.

Ein Turn wird auf der Stufe des Modells berechnet, das ihn beantwortet hat, sodass ein Gespräch, das zwischen Familien wechselt, pro Turn zum jeweiligen Antwortmodell-Satz abgerechnet wird. Credits werden nicht übertragen: Der Saldo summiert die Nutzung innerhalb des aktuellen Zeitraums, und der Beginn eines neuen Zeitraums ist selbst der Reset. Es gibt keinen Weg zum Nachladen.

Credit-Multiplikatoren werden nur auf Plattformen berechnet, die in der Credit-Allowlist stehen, aktuell nur die Web-App. Eine Plattform außerhalb der Allowlist sieht einen festen Faktor von 1x, wird pro Turn mit einem berechnet und behält das ältere Nachrichtenkontingent. Bei Starter sind beide Kontingente dieselbe Zahl, 400. Bei Pro und Powerhouse nicht, das sind die zweite und dritte Spalte der Tabelle oben.

Die vollständige Leiter, alle vierzehn belegten Stufen, steht in der Credits-Referenz.

Die Plan-Sperre, genau erklärt

Der Zugriff wird serverseitig anhand der Kennung entschieden (siehe die Modellreferenz).

Starter erreicht genau vier Einträge in der Auswahl: Auto, Whizi AI, ein OpenAI Modell und ein Google Modell. Kein Llama Modell ist darunter.

Pro fügt das Llama Set zu Starter hinzu. Als Kuratierungsregel für eine Familie gelesen, besteht dieses Set aus den aktuellen Llama 4 Modellen plus dem älteren Llama 3 Arbeitspferd, drei Kennungen insgesamt.

Powerhouse enthält alles, was Pro erreicht, weil die Stufenrangfolge mit einem Größer-gleich-Test verglichen wird, sodass eine höhere Stufe eine niedrigere Anforderung immer erfüllt. Powerhouse ist auch dort, wo jede Katalog-Kennung landet, die weder bei Starter noch bei Pro genannt wird, weshalb eine nicht gelistete Llama Kennung Powerhouse ist, bis sie bewusst hochgestuft wird.

Die Auswahl eines Modells oberhalb der eigenen Stufe liefert HTTP 403 mit dem Code tier_upgrade_required und der Meldung "Upgrade your plan to use this model." Dieses Symptom wird in wenn ein Modell nicht verfügbar ist behandelt.

Kostenlose Konten erreichen kein Llama Modell: Seit 2026-09-02 öffnet die kostenlose Stufe nur Whizi AI und Auto und sonst nichts. Das kostenlose Credit-Kontingent ist 0, und das Nachrichtenkontingent beträgt 7 Nachrichten am ersten Tag, danach 3 pro Tag, verbraucht für diese beiden Modelle.

Kontextfenster im Vergleich zu dem, was ein Turn tatsächlich bekommt

Das Kontextfenster in der Tabelle oben ist das vom Modell veröffentlichte Fenster. Es ist nicht das Budget, mit dem ein einzelner Whizi Turn läuft.

Jedes Katalogmodell erhält ein festes Budget von 40.000 Input-Token und 20.000 Output-Token pro Turn. Ein Modell, dessen Fenster unter 93.000 Token liegt, erhält stattdessen ein kleineres, proportionales Budget, wobei der Output auf 40 Prozent des Fensters gedeckelt ist und eine Sicherheitsmarge von 1.000 Token zurückgehalten wird.

Da beide bepreisten Llama Modelle über der Schwelle von 93.000 Token liegen, laufen beide mit demselben festen Budget von 40.000 Input- und 20.000 Output-Token. Das größere veröffentlichte Fenster erhöht nicht, was ein einzelner Whizi Turn sendet, und der Anbieter rechnet die angeforderte maximale Ausgabe ebenso wie den Input auf das Fenster an, sodass das 1M Modell und das 131K Modell hier identisch dimensioniert sind. Wenn ein Thread das Budget übersteigt, siehe wenn ein Gespräch zu lang ist.

Wo diese Modelle im Cost Index stehen

Der Cost Index bepreist 100 Modelle über 29 Anbieter hinweg jeweils zu einer Standardantwort. Diese Zahl ist die Größe des Preisindex, nicht die Größe des Whizi Katalogs.

ReferenzpunktKosten pro Standardantwort
Günstigstes bepreistes Modell im Index$0.000053
Median bepreistes Modell$0.00185
Llama 3.3 70B Instruct$0.00026
Llama 4 Maverick$0.0006
Teuerstes bepreistes Modell im Index$0.105

Beide bepreisten Llama Modelle liegen unter dem Median des Index, und die Spanne zwischen dem günstigsten und teuersten bepreisten Modell beträgt etwa das 2000-fache. 89 der 100 bepreisten Modelle tragen eine Whizi Credit-Berechnung; der Rest ist zum Vergleich bepreist, wird aber nicht als eigenes, gemessenes Modell angeboten.

Wofür Llama in Whizi nicht genutzt wird

Kein Llama Modell steht auf der Auto Leiter. Auto hat sechs Stufen, und die Modelle darauf sind das Whizi Hausmodell für kurze Fragen, ein Gemini Flash Modell für Umformulierungen und noch einmal für Anhänge, ein GPT Modell für Langtexte, ein Claude Sonnet Modell für Code und ein zweites GPT Modell für mehrstufiges Schlussfolgern. Keine Llama Kennung erscheint auf einer der sechs, sodass Auto Llama auf keiner Stufe erreichen kann und eine Llama Antwort immer eine manuelle Auswahl im Modell-Picker ist.

Anhänge bei Auto gehen woanders hin. Auto leitet jeden Turn mit Anhang an Gemini Flash weiter, mit der Begründung, dass ein Bild eher Vision als ein großes Fenster braucht. Wählt man selbst ein Llama Modell, wird der Anhang pro Anfrage statt pro Modell behandelt. In der App wird er an das Modell weitergeleitet, auf dem der Turn gerade läuft, und nur die jüngste Nutzernachricht mit Anhängen wird weitergeleitet. Im Web wird bei einer PDF-, Word- oder Tabellendatei der Text im Browser extrahiert, und dieser Text erreicht das Modell.

Sprache und Mediengenerierung sind keine Auswahl pro Modell. Mediengeneratoren überspringen die Modell-Sperre komplett und werden stattdessen nach Picker-Bereich gestuft, und der Sprachmodus läuft auf einer eigenen Echtzeit-Route, sodass die Wahl eines Llama Modells keins von beiden ändert.

Whizi veröffentlicht keine Vision-Unterstützung pro Modell. Es gibt nirgendwo im Katalog oder im Cost Index ein Vision- oder Multimodal-Flag, sodass Whizi nicht sagen kann, welches Llama Modell ein Bild liest. Bildteile werden an das Modell weitergeleitet, auf dem der Turn läuft, und das Ergebnis liegt zwischen dir und dem Modell.

Checkliste
  • Llama ist im Katalog, und alle drei Modelle im Pro Set kosten 1 Credit pro Nachricht
  • Pro ist der Plan, der das Llama Set freischaltet, und Powerhouse enthält es
  • Starter enthält kein Llama Modell
  • Ein kostenloses Konto erreicht kein Llama Modell: Pro ist der niedrigste Plan, der es tut
  • Ein Llama Turn läuft mit dem festen Budget von 40.000 Input- und 20.000 Output-Token, weil beide bepreisten Modelle über der Schwelle von 93.000 Token liegen
  • Kein Llama Modell steht auf einer der sechs Auto Stufen, sodass Llama immer eine manuelle Auswahl ist
  • Whizi veröffentlicht kein Vision-Flag pro Modell, sodass nicht ersichtlich ist, welches Llama Modell ein Bild liest

Häufige Fragen

Welche Llama Modelle bietet Whizi?

Das Pro Modell-Set nennt drei Llama Kennungen: die beiden Llama 4 Varianten plus das Llama 3 Arbeitspferd, und alle drei kosten 1 Credit pro Nachricht. Zwei davon sind im Whizi Cost Index bepreist, mit veröffentlichten Kontextfenstern von 1M und 131K. Der Katalog kann weitere Llama Kennungen führen, und alles, was weder bei Starter noch bei Pro genannt wird, erfordert Powerhouse.

Wie viele Credits kostet eine Llama Nachricht?

Ein Credit, das ist die unterste Stufe der Leiter und dasselbe wie eine Nachricht auf dem Whizi Hausmodell. Weder Starter noch die kostenlose Stufe öffnen überhaupt ein Llama Modell, sodass Pro der erste Plan ist, bei dem dieser 1 Credit hier etwas kauft.

Brauche ich den teuersten Plan, um Llama zu nutzen?

Nein. Pro ist der günstigste Plan, der ein Llama Modell öffnet, für $29.99/Monat. Starter erreicht keines, Powerhouse wird nur für eine Llama Kennung benötigt, die das Pro Set nicht nennt, und ein kostenloses Konto erreicht keines von beiden: Es läuft mit Whizi AI und Auto.

Kann ich ein Gespräch von Llama zu einem anderen Modell wechseln?

Ja. Jeder Turn wird auf der Stufe des Modells berechnet, das ihn beantwortet hat, sodass ein Thread, der zwischen Familien wechselt, pro Turn zum jeweiligen Satz abgerechnet wird, statt auf Thread-Ebene. Ein Modell verlässt den Katalog nie, nachdem es einmal angeboten wurde, weil ein Gespräch das Modell trägt, mit dem es erstellt wurde, sodass ein alter Llama Thread auch später noch öffnet. Die Mechanik steht in Modelle mitten im Gespräch wechseln.

Was kann ich an einen Llama Turn anhängen?

Anhänge werden pro Anfrage statt pro Modell behandelt, und sie kosten selbst keine Credits. Die Grenzen liegen bei 10 MB pro Datei, 4 Anhängen pro Prompt und 20 MB insgesamt pro Prompt. Akzeptiert werden JPEG, PNG, WebP, GIF, PDF, Klartext, Markdown, CSV und JSON.

Funktioniert die Websuche mit Llama?

Whizi veröffentlicht keine Websuche-Liste pro Modell. Suche ist ein Umschalter pro Anfrage mit drei Modi, aus, probe und nativ, statt einem Fähigkeits-Flag pro Modell, und die Matrix pro Modell wurde nie aufgelistet, sodass es keine Llama spezifische Antwort dazu gibt. Der Umschalter selbst wird in Websuche behandelt.