Die kurze Antwort
GLM 4.6 ist ein Z.ai-Modell mit einem Preis von $0.5 pro Million Eingabetoken und $2 pro Million Ausgabetoken, mit einem Kontextfenster von 205K Token. Eine Standardantwort, das heißt 1.000 Token Eingabe und 500 Token Ausgabe, kostet $0.0015. In Whizi kostet es 1 Credit pro Nachricht und erfordert den Powerhouse-Plan oder höher.
Das macht es preislich mittelständig im Katalog: 48 der 89 bepreisten Modelle kosten pro Antwort mehr, und 40 kosten weniger.
Was GLM 4.6 kostet
Listenpreise sind das, was der Anbieter pro Token berechnet. Die Kosten einer Standardantwort sind die nützlichere Zahl, weil sie dieselbe Arbeitseinheit über alle Modelle hinweg bepreist, unabhängig davon, wie jedes einzelne abgerechnet wird.
| Eingabe, pro Million Token | $0.5 |
| Ausgabe, pro Million Token | $2 |
| Eine Standardantwort | $0.0015 |
| Tausend Antworten | $1.50 |
| Kontextfenster | 205K Token |
| Credits pro Nachricht in Whizi | 1 |
| Mindest-Whizi-Plan | Powerhouse |
| Rang nach Kosten, von 89 bepreisten Modellen | 41 |
Die Preise sind die veröffentlichten Z.ai-Tarife, wie sie von OpenRouter übernommen werden, zuletzt aktualisiert am 2026-08-20. Der vollständige Datensatz mit allen 100 Modellen von 29 Anbietern ist der KI-Modellkosten-Index, der zur freien Weiterverwendung mit Namensnennung verfügbar ist.
Was es in Whizi kostet
Whizi misst Nachrichten in Credits statt in Token, und GLM 4.6 wird mit 1 Credit pro Nachricht berechnet. Die Kosten ändern sich nicht mit der Länge deiner Nachricht oder der Länge der Antwort, sodass eine einzeilige Frage und eine lange Dokumentenanalyse gleich viel kosten.
| Plan | Preis pro Monat | Monatliche Credits | Nachrichten mit diesem Modell |
|---|---|---|---|
| Powerhouse | $49.99, oder $34.99 jährlich abgerechnet | 8.000 | 8.000 |
GLM 4.6 gehört zum Powerhouse-Katalog. Alles, was nicht ausdrücklich in den Stufen Starter oder Pro aufgeführt ist, fällt auf Powerhouse zurück, was die bewusste Standardeinstellung für Frontier- und Spezialmodelle ist. Siehe Pläne und Limits.
Wie es preislich abschneidet
Im Vergleich zum günstigsten Modell im Index, Ling-3.0-flash mit $0.000053 pro Antwort, kostet GLM 4.6 28-mal mehr. Im Vergleich zum Median, Kimi K2 0711 mit $0.0017, kostet es etwa gleich viel.
Seine nächsten Nachbarn von Z.ai:
| Modell | Eine Antwort | Kontext | Credits |
|---|---|---|---|
| GLM 4.7 | $0.0013 | 205K | 2 |
| GLM 4.6 (diese Seite) | $0.0015 | 205K | 1 |
| GLM 5 | $0.0016 | 205K | 2 |
| GLM 5.2 | $0.0025 | 1M | 3 |
Wenn GLM 4.6 mehr Modell ist, als eine bestimmte Aufgabe braucht, ist GLM 4.7 die günstigere Z.ai-Option mit $0.0013 pro Antwort und 2 Credits pro Nachricht. Routineaufgaben eine Stufe tiefer zu leiten, ist das Wichtigste, was du tun kannst, damit ein Kontingent länger reicht.
Das Kontextfenster in der Praxis
GLM 4.6 akzeptiert 205K Token an Kontext, was etwa 310 Seiten Text entspricht. Das liegt unter dem Median für den bepreisten Katalog.
Angegebener und nutzbarer Kontext sind nicht dasselbe. Die Erinnerungsfähigkeit lässt tendenziell nach, bevor das angegebene Limit erreicht wird, besonders bei Material in der Mitte einer langen Eingabe, daher besteht der praktische Test darin, ein langes Dokument hochzuladen und nach etwas zu fragen, das etwa in der Mitte vergraben ist, statt der Zahl blind zu vertrauen.
Die Zahl ist am wichtigsten, wenn du mit deinen eigenen Dateien arbeitest. Wenn ein Dokument zu lang für das gewählte Modell ist, überträgt der Wechsel zu einem Modell mit größerem Kontext innerhalb derselben Konversation den Gesprächsfaden, sodass du nicht von vorn beginnen musst. Siehe Modelle mitten im Gespräch wechseln.
- Eingabe $0.5 und Ausgabe $2 pro Million Token
- $0.0015 für eine Standardantwort, $1.50 für tausend
- 205K Token Kontextfenster
- 1 Credit pro Nachricht in Whizi
- Erfordert den Powerhouse-Plan oder höher
- Rang 41 von 89 bepreisten Modellen nach Kosten pro Antwort
Häufige Fragen
Wie viel kostet GLM 4.6?
$0.5 pro Million Eingabetoken und $2 pro Million Ausgabetoken bei Listenpreisen, was $0.0015 für eine Standardantwort von 1.000 Token Eingabe und 500 Token Ausgabe ergibt, oder $1.50 für tausend davon. In Whizi ist es 1 Credit pro Nachricht auf ein monatliches Kontingent, statt pro Token abgerechnet.
Welcher Whizi-Plan enthält GLM 4.6?
Powerhouse und höher, was $49.99 pro Monat oder $34.99 jährlich abgerechnet kostet. Bei 1 Credit pro Nachricht deckt ein Powerhouse-Kontingent von 8.000 Credits 8.000 Nachrichten mit diesem Modell ab, wenn du das gesamte Kontingent hier ausgibst, und die meisten mischen ein 1-Credit-Modell für Routineaufgaben ein, damit es länger reicht.
Wie groß ist das Kontextfenster von GLM 4.6?
205K Token, was etwa 310 Seiten Text entspricht und unter dem Median für den bepreisten Katalog liegt. Betrachte das als Obergrenze statt als Arbeitswert: Die Erinnerungsfähigkeit lässt meist nach, bevor das angegebene Limit erreicht wird, besonders bei Inhalten in der Mitte einer langen Eingabe.
Ist GLM 4.6 im Vergleich zu anderen Modellen teuer?
Es rangiert auf Platz 41 von 89 bepreisten Modellen nach Kosten pro Antwort, sodass 48 mehr und 40 weniger kosten. Die Spanne über den gesamten Katalog beträgt etwa das 2000-fache vom günstigsten bis zum teuersten Modell, was deutlich breiter ist, als die meisten annehmen, sodass "teuer" nur im Verhältnis zur konkreten Alternative Sinn ergibt, die du sonst nutzen würdest.