Die kurze Antwort
Llama 4 Maverick ist ein Meta-Modell, das mit $0.2 pro Million Input-Tokens und $0.8 pro Million Output-Tokens bepreist ist, mit einem Kontextfenster von 1M Tokens. Eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe, kostet $0.0006. In Whizi kostet es 1 Credit pro Nachricht und benötigt mindestens den Pro-Plan.
Damit gehört es zu den günstigeren Modellen im Katalog: 71 der 89 bepreisten Modelle kosten pro Antwort mehr, 17 kosten weniger.
Was Llama 4 Maverick kostet
Die Listenpreise geben an, was der Anbieter pro Token berechnet. Aussagekräftiger ist der Preis einer Standardantwort, da er dieselbe Arbeitseinheit über alle Modelle hinweg vergleichbar macht, unabhängig davon, wie jedes einzelne abgerechnet wird.
| Input, pro Million Tokens | $0.2 |
| Output, pro Million Tokens | $0.8 |
| Eine Standardantwort | $0.0006 |
| Eintausend Antworten | $0.6000 |
| Kontextfenster | 1M Tokens |
| Credits pro Nachricht in Whizi | 1 |
| Mindest-Whizi-Plan | Pro |
| Rang nach Kosten, von 89 bepreisten Modellen | 18 |
Die Preise entsprechen den veröffentlichten Meta-Tarifen, wie sie von OpenRouter geführt werden, zuletzt aktualisiert am 2026-08-20. Der vollständige Datensatz mit allen 100 Modellen von 29 Anbietern ist der AI model cost index, der frei mit Quellenangabe weiterverwendet werden darf.
Was es innerhalb von Whizi kostet
Whizi misst Nachrichten in Credits statt in Tokens, und Llama 4 Maverick wird mit 1 Credit pro Nachricht berechnet. Die Kosten ändern sich nicht mit der Länge der Nachricht oder der Antwort, eine einzeilige Frage und eine lange Dokumentenanalyse kosten also gleich viel.
| Plan | Preis pro Monat | Monatliche Credits | Nachrichten mit diesem Modell |
|---|---|---|---|
| Pro | $29.99, oder $19.99 bei jährlicher Abrechnung | 2.000 | 2.000 |
| Powerhouse | $49.99, oder $34.99 bei jährlicher Abrechnung | 8.000 | 8.000 |
Llama 4 Maverick ist ab dem Pro-Plan enthalten. Pro ist eine kuratierte Stufe und nicht einfach alles Günstige: ein oder zwei aktuelle Flaggschiffe pro Modellfamilie, jeweils die schnelle Stufe und die vielgenutzten Arbeitspferde. Siehe plans and limits.
Wie es preislich abschneidet
Im Vergleich zum günstigsten Modell im Index, Ling-3.0-flash mit $0.000053 pro Antwort, kostet Llama 4 Maverick 11 mal mehr. Im Vergleich zum Median, Kimi K2 0711 mit $0.0017, kostet es 2,9 mal weniger.
Seine nächsten Nachbarn von Meta:
| Modell | Eine Antwort | Kontext | Credits |
|---|---|---|---|
| Llama 3.3 70B Instruct | $0.0003 | 131K | 1 |
| Llama 4 Maverick (diese Seite) | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
Wenn Llama 4 Maverick mehr Modell ist, als eine bestimmte Aufgabe braucht, ist Llama 3.3 70B Instruct die günstigere Meta-Option mit $0.0003 pro Antwort und 1 Credit pro Nachricht. Routineaufgaben eine Stufe tiefer zu routen ist der wirksamste Hebel, um ein Guthaben länger reichen zu lassen.
Das Kontextfenster in der Praxis
Llama 4 Maverick akzeptiert 1M Tokens Kontext, was ungefähr 1600 Textseiten entspricht. Das liegt deutlich über dem Median des bepreisten Katalogs.
Beworbener und tatsächlich nutzbarer Kontext sind nicht dasselbe. Die Erinnerungsleistung lässt oft schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte eines langen Eingabetexts. Der praktische Test besteht darin, ein langes Dokument hochzuladen und nach etwas zu fragen, das mittendrin vergraben ist, statt sich auf die Zahl zu verlassen.
Die Zahl zählt am meisten, wenn mit eigenen Dateien gearbeitet wird. Ist ein Dokument zu lang für das gewählte Modell, überträgt ein Wechsel zu einem Modell mit größerem Kontext innerhalb derselben Unterhaltung den Gesprächsfaden, sodass nicht von vorn begonnen werden muss. Siehe switching models mid-conversation.
- Input $0.2 und Output $0.8 pro Million Tokens
- $0.0006 für eine Standardantwort, $0.6000 für tausend
- 1M Tokens Kontextfenster
- 1 Credit pro Nachricht in Whizi
- Erfordert mindestens den Pro-Plan
- Rang 18 von 89 bepreisten Modellen nach Kosten pro Antwort
Häufige Fragen
Wie viel kostet Llama 4 Maverick?
$0.2 pro Million Input-Tokens und $0.8 pro Million Output-Tokens zum Listenpreis, was $0.0006 für eine Standardantwort aus 1.000 Tokens Eingabe und 500 Tokens Ausgabe ergibt, oder $0.6000 für tausend davon. In Whizi ist es 1 Credit pro Nachricht aus einem monatlichen Guthaben, statt pro Token abgerechnet.
Welcher Whizi-Plan enthält Llama 4 Maverick?
Pro und höher, was $29.99 pro Monat oder $19.99 bei jährlicher Abrechnung kostet. Bei 1 Credit pro Nachricht deckt ein Pro-Guthaben von 2.000 Credits 2.000 Nachrichten mit diesem Modell ab, wenn das gesamte Guthaben hier ausgegeben wird. Die meisten mischen für Routineaufgaben ein Modell mit 1 Credit dazu, damit es länger reicht.
Wie groß ist das Kontextfenster von Llama 4 Maverick?
1M Tokens, was ungefähr 1600 Textseiten entspricht und deutlich über dem Median des bepreisten Katalogs liegt. Das sollte eher als Obergrenze denn als Arbeitswert gelten: Die Erinnerungsleistung lässt meist schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte eines langen Eingabetexts.
Ist Llama 4 Maverick teuer im Vergleich zu anderen Modellen?
Es liegt auf Rang 18 von 89 bepreisten Modellen nach Kosten pro Antwort, 71 kosten also mehr und 17 weniger. Die Spanne über den gesamten Katalog beträgt etwa das 2000-fache vom günstigsten bis zum teuersten Modell, deutlich breiter, als die meisten annehmen. "Teuer" bedeutet also nur etwas im Verhältnis zur konkreten Alternative, die sonst genutzt würde.