Die kurze Antwort
Llama 3.3 70B Instruct ist ein Modell von Meta, bepreist mit $0.1 pro Million Input-Tokens und $0.32 pro Million Output-Tokens, mit einem Kontextfenster von 131K Tokens. Eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe, kostet $0.0003. In Whizi kostet es 1 Credit pro Nachricht und benötigt den Pro-Plan oder höher.
Damit gehört es zu den günstigeren Modellen im Katalog: 79 der 89 bepreisten Modelle kosten pro Antwort mehr, 9 kosten weniger.
Was Llama 3.3 70B Instruct kostet
Listenpreise geben an, was der Anbieter pro Token berechnet. Die Kosten einer Standardantwort sind die nützlichere Zahl, denn sie bepreisen dieselbe Arbeitseinheit über alle Modelle hinweg, unabhängig davon, wie jedes einzelne abgerechnet wird.
| Eingabe, pro Million Tokens | $0.1 |
| Ausgabe, pro Million Tokens | $0.32 |
| Eine Standardantwort | $0.0003 |
| Eintausend Antworten | $0.2600 |
| Kontextfenster | 131K Tokens |
| Credits pro Nachricht in Whizi | 1 |
| Mindest-Whizi-Plan | Pro |
| Rang nach Kosten, von 89 bepreisten Modellen | 10 |
Die Preise sind die veröffentlichten Meta-Tarife, wie von OpenRouter geführt, zuletzt aktualisiert am 2026-08-20. Der vollständige Datensatz mit allen 100 Modellen von 29 Anbietern ist der AI model cost index, der mit Namensnennung frei weiterverwendet werden darf.
Was es in Whizi kostet
Whizi misst Nachrichten in Credits statt in Tokens, und Llama 3.3 70B Instruct wird mit 1 Credit pro Nachricht berechnet. Die Kosten ändern sich nicht mit der Länge deiner Nachricht oder der Antwort, eine einzeilige Frage und eine lange Dokumentenanalyse kosten also gleich viel.
| Plan | Preis pro Monat | Monatliche Credits | Nachrichten mit diesem Modell |
|---|---|---|---|
| Pro | $29.99, oder $19.99 bei jährlicher Abrechnung | 2.000 | 2.000 |
| Powerhouse | $49.99, oder $34.99 bei jährlicher Abrechnung | 8.000 | 8.000 |
Llama 3.3 70B Instruct ist ab dem Pro-Plan enthalten. Pro ist eine kuratierte Stufe und nicht einfach alles Günstige: ein oder zwei aktuelle Flaggschiffe pro Modellfamilie, jede schnelle Stufe und die vielgenutzten Arbeitspferde. Siehe Pläne und Limits.
Wie es preislich abschneidet
Im Vergleich zum günstigsten Modell im Index, Ling-3.0-flash mit $0.000053 pro Antwort, kostet Llama 3.3 70B Instruct 4,9 Mal so viel. Im Vergleich zum Median, Kimi K2 0711 mit $0.0017, kostet es 6,6 Mal weniger.
Seine nächsten Nachbarn von Meta:
| Modell | Eine Antwort | Kontext | Credits |
|---|---|---|---|
| Llama 3.3 70B Instruct (diese Seite) | $0.0003 | 131K | 1 |
| Llama 4 Maverick | $0.0006 | 1M | 1 |
| Muse Glimmer 30B | $0.0011 | 131K | 2 |
| Muse Spark 1.2 | $0.0034 | 1M | 5 |
Es ist das günstigste Meta-Modell im bepreisten Index, innerhalb dieses Anbieters gibt es also nichts Billigeres, auf das man umsteigen könnte.
Das Kontextfenster in der Praxis
Llama 3.3 70B Instruct akzeptiert 131K Tokens an Kontext, was etwa 200 Textseiten entspricht. Das liegt unter dem Median des bepreisten Katalogs.
Angegebener und nutzbarer Kontext sind nicht dasselbe. Die Erinnerungsleistung lässt oft schon vor dem angegebenen Limit nach, besonders bei Material in der Mitte einer langen Eingabe. Der praktische Test besteht darin, ein langes Dokument hochzuladen und nach etwas zu fragen, das irgendwo in der Mitte vergraben ist, statt der Zahl blind zu vertrauen.
Die Zahl zählt am meisten, wenn du mit eigenen Dateien arbeitest. Ist ein Dokument zu lang für das gewählte Modell, überträgt ein Wechsel zu einem Modell mit größerem Kontext innerhalb derselben Konversation den Gesprächsverlauf, sodass du nicht von vorne beginnst. Siehe Modelle mitten im Gespräch wechseln.
- Eingabe $0.1 und Ausgabe $0.32 pro Million Tokens
- $0.0003 für eine Standardantwort, $0.2600 für tausend
- 131K Tokens Kontextfenster
- 1 Credit pro Nachricht in Whizi
- Erfordert den Pro-Plan oder höher
- Rang 10 von 89 bepreisten Modellen nach Kosten pro Antwort
Häufige Fragen
Wie viel kostet Llama 3.3 70B Instruct?
$0.1 pro Million Input-Tokens und $0.32 pro Million Output-Tokens zu Listenpreisen, was $0.0003 für eine Standardantwort mit 1.000 Tokens Eingabe und 500 Tokens Ausgabe ergibt, oder $0.2600 für tausend davon. In Whizi ist es 1 Credit pro Nachricht innerhalb eines monatlichen Kontingents, statt pro Token abgerechnet.
Welcher Whizi-Plan enthält Llama 3.3 70B Instruct?
Pro und höher, für $29.99 pro Monat oder $19.99 bei jährlicher Abrechnung. Bei 1 Credit pro Nachricht deckt ein Pro-Kontingent von 2.000 Credits 2.000 Nachrichten mit diesem Modell ab, falls du das gesamte Kontingent hier ausgibst. Die meisten mischen für Routineaufgaben ein Modell mit 1 Credit dazu, damit es länger reicht.
Wie groß ist das Kontextfenster von Llama 3.3 70B Instruct?
131K Tokens, was etwa 200 Textseiten entspricht und unter dem Median des bepreisten Katalogs liegt. Behandle das als Obergrenze, nicht als Arbeitswert: Die Erinnerungsleistung lässt meist schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte einer langen Eingabe.
Ist Llama 3.3 70B Instruct teuer im Vergleich zu anderen Modellen?
Es liegt auf Rang 10 von 89 bepreisten Modellen nach Kosten pro Antwort, 79 kosten also mehr und 9 kosten weniger. Die Spanne über den gesamten Katalog beträgt etwa das 2000-Fache vom günstigsten bis zum teuersten Modell, weit größer, als die meisten annehmen, daher bedeutet "teuer" nur etwas im Verhältnis zur konkreten Alternative, die man sonst nutzen würde.