Llama 3.3 70B Instruct: Preis, Kontextfenster und Credit-Kosten

Kurzantwort

Llama 3.3 70B Instruct kostet $0.0003 für eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe. Die Listenpreise liegen bei $0.1 pro Million Input-Tokens und $0.32 pro Million Output-Tokens. Das Kontextfenster umfasst 131K Tokens, unter dem Katalog-Median. In Whizi kostet es 1 Credit pro Nachricht ab dem Pro-Plan.

Die kurze Antwort

Llama 3.3 70B Instruct ist ein Modell von Meta, bepreist mit $0.1 pro Million Input-Tokens und $0.32 pro Million Output-Tokens, mit einem Kontextfenster von 131K Tokens. Eine Standardantwort, also 1.000 Tokens Eingabe und 500 Tokens Ausgabe, kostet $0.0003. In Whizi kostet es 1 Credit pro Nachricht und benötigt den Pro-Plan oder höher.

Damit gehört es zu den günstigeren Modellen im Katalog: 79 der 89 bepreisten Modelle kosten pro Antwort mehr, 9 kosten weniger.

Was Llama 3.3 70B Instruct kostet

Listenpreise geben an, was der Anbieter pro Token berechnet. Die Kosten einer Standardantwort sind die nützlichere Zahl, denn sie bepreisen dieselbe Arbeitseinheit über alle Modelle hinweg, unabhängig davon, wie jedes einzelne abgerechnet wird.

Eingabe, pro Million Tokens$0.1
Ausgabe, pro Million Tokens$0.32
Eine Standardantwort$0.0003
Eintausend Antworten$0.2600
Kontextfenster131K Tokens
Credits pro Nachricht in Whizi1
Mindest-Whizi-PlanPro
Rang nach Kosten, von 89 bepreisten Modellen10

Die Preise sind die veröffentlichten Meta-Tarife, wie von OpenRouter geführt, zuletzt aktualisiert am 2026-08-20. Der vollständige Datensatz mit allen 100 Modellen von 29 Anbietern ist der AI model cost index, der mit Namensnennung frei weiterverwendet werden darf.

Was es in Whizi kostet

Whizi misst Nachrichten in Credits statt in Tokens, und Llama 3.3 70B Instruct wird mit 1 Credit pro Nachricht berechnet. Die Kosten ändern sich nicht mit der Länge deiner Nachricht oder der Antwort, eine einzeilige Frage und eine lange Dokumentenanalyse kosten also gleich viel.

PlanPreis pro MonatMonatliche CreditsNachrichten mit diesem Modell
Pro$29.99, oder $19.99 bei jährlicher Abrechnung2.0002.000
Powerhouse$49.99, oder $34.99 bei jährlicher Abrechnung8.0008.000

Llama 3.3 70B Instruct ist ab dem Pro-Plan enthalten. Pro ist eine kuratierte Stufe und nicht einfach alles Günstige: ein oder zwei aktuelle Flaggschiffe pro Modellfamilie, jede schnelle Stufe und die vielgenutzten Arbeitspferde. Siehe Pläne und Limits.

Wie es preislich abschneidet

Im Vergleich zum günstigsten Modell im Index, Ling-3.0-flash mit $0.000053 pro Antwort, kostet Llama 3.3 70B Instruct 4,9 Mal so viel. Im Vergleich zum Median, Kimi K2 0711 mit $0.0017, kostet es 6,6 Mal weniger.

Seine nächsten Nachbarn von Meta:

ModellEine AntwortKontextCredits
Llama 3.3 70B Instruct (diese Seite)$0.0003131K1
Llama 4 Maverick$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

Es ist das günstigste Meta-Modell im bepreisten Index, innerhalb dieses Anbieters gibt es also nichts Billigeres, auf das man umsteigen könnte.

Das Kontextfenster in der Praxis

Llama 3.3 70B Instruct akzeptiert 131K Tokens an Kontext, was etwa 200 Textseiten entspricht. Das liegt unter dem Median des bepreisten Katalogs.

Angegebener und nutzbarer Kontext sind nicht dasselbe. Die Erinnerungsleistung lässt oft schon vor dem angegebenen Limit nach, besonders bei Material in der Mitte einer langen Eingabe. Der praktische Test besteht darin, ein langes Dokument hochzuladen und nach etwas zu fragen, das irgendwo in der Mitte vergraben ist, statt der Zahl blind zu vertrauen.

Die Zahl zählt am meisten, wenn du mit eigenen Dateien arbeitest. Ist ein Dokument zu lang für das gewählte Modell, überträgt ein Wechsel zu einem Modell mit größerem Kontext innerhalb derselben Konversation den Gesprächsverlauf, sodass du nicht von vorne beginnst. Siehe Modelle mitten im Gespräch wechseln.

Checkliste
  • Eingabe $0.1 und Ausgabe $0.32 pro Million Tokens
  • $0.0003 für eine Standardantwort, $0.2600 für tausend
  • 131K Tokens Kontextfenster
  • 1 Credit pro Nachricht in Whizi
  • Erfordert den Pro-Plan oder höher
  • Rang 10 von 89 bepreisten Modellen nach Kosten pro Antwort

Häufige Fragen

Wie viel kostet Llama 3.3 70B Instruct?

$0.1 pro Million Input-Tokens und $0.32 pro Million Output-Tokens zu Listenpreisen, was $0.0003 für eine Standardantwort mit 1.000 Tokens Eingabe und 500 Tokens Ausgabe ergibt, oder $0.2600 für tausend davon. In Whizi ist es 1 Credit pro Nachricht innerhalb eines monatlichen Kontingents, statt pro Token abgerechnet.

Welcher Whizi-Plan enthält Llama 3.3 70B Instruct?

Pro und höher, für $29.99 pro Monat oder $19.99 bei jährlicher Abrechnung. Bei 1 Credit pro Nachricht deckt ein Pro-Kontingent von 2.000 Credits 2.000 Nachrichten mit diesem Modell ab, falls du das gesamte Kontingent hier ausgibst. Die meisten mischen für Routineaufgaben ein Modell mit 1 Credit dazu, damit es länger reicht.

Wie groß ist das Kontextfenster von Llama 3.3 70B Instruct?

131K Tokens, was etwa 200 Textseiten entspricht und unter dem Median des bepreisten Katalogs liegt. Behandle das als Obergrenze, nicht als Arbeitswert: Die Erinnerungsleistung lässt meist schon vor dem angegebenen Limit nach, besonders bei Inhalten in der Mitte einer langen Eingabe.

Ist Llama 3.3 70B Instruct teuer im Vergleich zu anderen Modellen?

Es liegt auf Rang 10 von 89 bepreisten Modellen nach Kosten pro Antwort, 79 kosten also mehr und 9 kosten weniger. Die Spanne über den gesamten Katalog beträgt etwa das 2000-Fache vom günstigsten bis zum teuersten Modell, weit größer, als die meisten annehmen, daher bedeutet "teuer" nur etwas im Verhältnis zur konkreten Alternative, die man sonst nutzen würde.