Llama 4 Maverick: Preis, Kontextfenster und Credit-Kosten

Kurzantwort

Llama 4 Maverick kostet $0.0006 für eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe. Die Listenpreise liegen bei $0.2 pro Million Input-Tokens und $0.8 pro Million Output-Tokens. Das Kontextfenster umfasst 1M Tokens, deutlich über dem Katalog-Median. In Whizi kostet es 1 Credit pro Nachricht ab dem Pro-Plan.

Die kurze Antwort

Llama 4 Maverick ist ein Meta-Modell, das mit $0.2 pro Million Input-Tokens und $0.8 pro Million Output-Tokens bepreist ist, mit einem Kontextfenster von 1M Tokens. Eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe, kostet $0.0006. In Whizi kostet es 1 Credit pro Nachricht und benötigt mindestens den Pro-Plan.

Damit gehört es zu den günstigeren Modellen im Katalog: 71 der 89 bepreisten Modelle kosten pro Antwort mehr, 17 kosten weniger.

Was Llama 4 Maverick kostet

Die Listenpreise geben an, was der Anbieter pro Token berechnet. Aussagekräftiger ist der Preis einer Standardantwort, da er dieselbe Arbeitseinheit über alle Modelle hinweg vergleichbar macht, unabhängig davon, wie jedes einzelne abgerechnet wird.

Input, pro Million Tokens$0.2
Output, pro Million Tokens$0.8
Eine Standardantwort$0.0006
Eintausend Antworten$0.6000
Kontextfenster1M Tokens
Credits pro Nachricht in Whizi1
Mindest-Whizi-PlanPro
Rang nach Kosten, von 89 bepreisten Modellen18

Die Preise entsprechen den veröffentlichten Meta-Tarifen, wie sie von OpenRouter geführt werden, zuletzt aktualisiert am 2026-08-20. Der vollständige Datensatz mit allen 100 Modellen von 29 Anbietern ist der AI model cost index, der frei mit Quellenangabe weiterverwendet werden darf.

Was es innerhalb von Whizi kostet

Whizi misst Nachrichten in Credits statt in Tokens, und Llama 4 Maverick wird mit 1 Credit pro Nachricht berechnet. Die Kosten ändern sich nicht mit der Länge der Nachricht oder der Antwort, eine einzeilige Frage und eine lange Dokumentenanalyse kosten also gleich viel.

PlanPreis pro MonatMonatliche CreditsNachrichten mit diesem Modell
Pro$29.99, oder $19.99 bei jährlicher Abrechnung2.0002.000
Powerhouse$49.99, oder $34.99 bei jährlicher Abrechnung8.0008.000

Llama 4 Maverick ist ab dem Pro-Plan enthalten. Pro ist eine kuratierte Stufe und nicht einfach alles Günstige: ein oder zwei aktuelle Flaggschiffe pro Modellfamilie, jeweils die schnelle Stufe und die vielgenutzten Arbeitspferde. Siehe plans and limits.

Wie es preislich abschneidet

Im Vergleich zum günstigsten Modell im Index, Ling-3.0-flash mit $0.000053 pro Antwort, kostet Llama 4 Maverick 11 mal mehr. Im Vergleich zum Median, Kimi K2 0711 mit $0.0017, kostet es 2,9 mal weniger.

Seine nächsten Nachbarn von Meta:

ModellEine AntwortKontextCredits
Llama 3.3 70B Instruct$0.0003131K1
Llama 4 Maverick (diese Seite)$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

Wenn Llama 4 Maverick mehr Modell ist, als eine bestimmte Aufgabe braucht, ist Llama 3.3 70B Instruct die günstigere Meta-Option mit $0.0003 pro Antwort und 1 Credit pro Nachricht. Routineaufgaben eine Stufe tiefer zu routen ist der wirksamste Hebel, um ein Guthaben länger reichen zu lassen.

Das Kontextfenster in der Praxis

Llama 4 Maverick akzeptiert 1M Tokens Kontext, was ungefähr 1600 Textseiten entspricht. Das liegt deutlich über dem Median des bepreisten Katalogs.

Beworbener und tatsächlich nutzbarer Kontext sind nicht dasselbe. Die Erinnerungsleistung lässt oft schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte eines langen Eingabetexts. Der praktische Test besteht darin, ein langes Dokument hochzuladen und nach etwas zu fragen, das mittendrin vergraben ist, statt sich auf die Zahl zu verlassen.

Die Zahl zählt am meisten, wenn mit eigenen Dateien gearbeitet wird. Ist ein Dokument zu lang für das gewählte Modell, überträgt ein Wechsel zu einem Modell mit größerem Kontext innerhalb derselben Unterhaltung den Gesprächsfaden, sodass nicht von vorn begonnen werden muss. Siehe switching models mid-conversation.

Checkliste
  • Input $0.2 und Output $0.8 pro Million Tokens
  • $0.0006 für eine Standardantwort, $0.6000 für tausend
  • 1M Tokens Kontextfenster
  • 1 Credit pro Nachricht in Whizi
  • Erfordert mindestens den Pro-Plan
  • Rang 18 von 89 bepreisten Modellen nach Kosten pro Antwort

Häufige Fragen

Wie viel kostet Llama 4 Maverick?

$0.2 pro Million Input-Tokens und $0.8 pro Million Output-Tokens zum Listenpreis, was $0.0006 für eine Standardantwort aus 1.000 Tokens Eingabe und 500 Tokens Ausgabe ergibt, oder $0.6000 für tausend davon. In Whizi ist es 1 Credit pro Nachricht aus einem monatlichen Guthaben, statt pro Token abgerechnet.

Welcher Whizi-Plan enthält Llama 4 Maverick?

Pro und höher, was $29.99 pro Monat oder $19.99 bei jährlicher Abrechnung kostet. Bei 1 Credit pro Nachricht deckt ein Pro-Guthaben von 2.000 Credits 2.000 Nachrichten mit diesem Modell ab, wenn das gesamte Guthaben hier ausgegeben wird. Die meisten mischen für Routineaufgaben ein Modell mit 1 Credit dazu, damit es länger reicht.

Wie groß ist das Kontextfenster von Llama 4 Maverick?

1M Tokens, was ungefähr 1600 Textseiten entspricht und deutlich über dem Median des bepreisten Katalogs liegt. Das sollte eher als Obergrenze denn als Arbeitswert gelten: Die Erinnerungsleistung lässt meist schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte eines langen Eingabetexts.

Ist Llama 4 Maverick teuer im Vergleich zu anderen Modellen?

Es liegt auf Rang 18 von 89 bepreisten Modellen nach Kosten pro Antwort, 71 kosten also mehr und 17 weniger. Die Spanne über den gesamten Katalog beträgt etwa das 2000-fache vom günstigsten bis zum teuersten Modell, deutlich breiter, als die meisten annehmen. "Teuer" bedeutet also nur etwas im Verhältnis zur konkreten Alternative, die sonst genutzt würde.