Najtańsze modele AI za odpowiedź w Whizi i co kupuje jeden kredyt

Krótka odpowiedź

Najtaniej wyceniony wiersz w indeksie kosztów Whizi to Ling od inclusionAI, za $0.000053 za jedną odpowiedź. Nalicza on jeden kredyt za wiadomość, tak jak każdy inny wiersz na dole drabinki, a żadna wiadomość nigdy nie kosztuje mniej niż jeden kredyt. Standardowa odpowiedź to 1000 tokenów wejściowych plus 500 tokenów wyjściowych.

Krótka odpowiedź

Najtaniej wyceniony wiersz w indeksie kosztów Whizi to Ling od inclusionAI, za $0.000053 za jedną odpowiedź. Nalicza on jeden kredyt za wiadomość, tak jak każdy inny wiersz na dole drabinki, a limit dolny na turę gwarantuje, że nic nigdy nie kosztuje mniej niż jeden kredyt.

Jeden tani wiersz na plan, jako wstęp do pełnych tabel poniżej:

ModelDostawcaKoszt za odpowiedźKontekstKredytyPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
GPT-5.6 LunaOpenAI$0.00081M1Starter

Standardowa odpowiedź w indeksie to 1000 tokenów wejściowych plus 500 tokenów wyjściowych, dzięki czemu cenniki różnych dostawców stają się porównywalne. Ceny źródłowe zostały pobrane z OpenRouter 2026-08-20. Indeks wycenia 100 wierszy od 29 dostawców, a 89 z tych wierszy niesie opłatę w kredytach Whizi. Pełny zestaw danych jest opublikowany jako indeks kosztów modeli AI.

Ta strona to tani koniec tego indeksu. Katalog według planu znajdziesz w liście modeli, a samą drabinkę kredytową w materiale referencyjnym o kredytach.

Wiersze poniżej dziesiątej części centa za odpowiedź

Wybór wierszy, które odpowiadają raz za mniej niż $0.001 przy standardowym rozmiarze odpowiedzi. Wszystkie oprócz jednego z wypisanych tu wierszy naliczają pojedynczy kredyt.

ModelDostawcaKoszt za odpowiedźKontekstKredytyPlan
Ling-3.0-flashinclusionAI$0.000053262K1Powerhouse
Nex-N2-MiniNex Agi$0.000075262K1Powerhouse
Solar Pro 4Upstage$0.00009524K1Powerhouse
Qwen3.7 FlashQwen$0.0000951M1Powerhouse
Granite 4.1 8BIBM$0.0001131K1Powerhouse
Laguna XS 2.1Poolside$0.00012262K1Powerhouse
Phi 4Microsoft$0.0001416K1Powerhouse
Nemotron 3.5 LightningNVIDIA$0.00018262K1Powerhouse
Llama 3.3 70B InstructMeta$0.00026131K1Pro
DeepSeek V4 Flash 0731DeepSeek$0.000281.31M1Powerhouse
Gemini 2.5 Flash LiteGoogle$0.00031M1Pro
DeepSeek V3.2DeepSeek$0.000469164K1Pro
Qwen3 Coder NextQwen$0.00052262K1Powerhouse
Llama 4 MaverickMeta$0.00061M1Pro
DeepSeek V3.1DeepSeek$0.000725164K1Pro
Codestral 2508Mistral$0.00075256K1Powerhouse
Qwen3.6 FlashQwen$0.000751M1Powerhouse
MiniMax M2MiniMax$0.000765205K1Powerhouse
GPT-5.6 LunaOpenAI$0.00081M1Starter
GPT-5.4 NanoOpenAI$0.000825400K2Powerhouse
MiniMax M3MiniMax$0.00091M1Powerhouse
Qwen3.7 PlusQwen$0.000961M1Pro

Kilka z najtańszych wierszy niesie milion tokenów lub więcej, a największe okno w całym indeksie cenowym należy do wiersza blisko dołu listy kosztów. Tanio i małe okno to tutaj nie ta sama oś. Najmniejsze okno wypisane powyżej to 16K.

Większość tych wierszy siedzi na najdroższym planie, z powodu opisanego niżej.

Kolejne pasmo, aż do mediany indeksu

Wierszem o medianowej cenie jest wiersz rozumowania Kimi za $0.00185 za standardową odpowiedź. Próbka wierszy między dziesiątą częścią centa a tą medianą:

ModelDostawcaKoszt za odpowiedźKontekstKredytyPlan
Gemini 3.1 Flash LiteGoogle$0.0011M1Powerhouse
Muse Glimmer 30BMeta$0.0011131K2Powerhouse
Mistral Large 3 2512Mistral$0.00125262K2Pro
GLM 4.7Z.ai$0.001275205K2Powerhouse
Gemini 3.7 FlashGoogle$0.0013131M2Pro
Mistral Medium 3.1Mistral$0.0014131K2Pro
GLM 4.6Z.ai$0.0015205K1Powerhouse
Gemini 2.5 FlashGoogle$0.001551M2Pro
Gemini 3.5 Flash LiteGoogle$0.001551M2Powerhouse
GLM 5Z.ai$0.00156205K2Pro
Kimi K2 0711Moonshot$0.00172131K10Powerhouse
Kimi K2 ThinkingMoonshot$0.00185262K10Powerhouse

Kolumna kredytów i kolumna dolarów nie obejmują tego samego zbioru wierszy. Jedenaście ze 100 wycenionych wierszy nie niesie żadnej opłaty w kredytach: są wycenione do porównania, ale nie są oferowane jako własny mierzony wiersz w produkcie. Kwota w dolarach w indeksie sama w sobie nie oznacza więc, że dany wiersz można otworzyć w selektorze.

Dlaczego większość najtańszych wierszy jest na Powerhouse

Kolumna planu powyżej to nie decyzja cenowa, tylko wartość domyślna. Dostęp do modelu rozstrzyga się po identyfikatorze: najpierw cztery identyfikatory Starter, potem persony agentów, potem jawna lista 37 kolejnych identyfikatorów dla Pro, a wszystko inne zwraca Powerhouse. Tani wiersz, którego nikt nigdy nie awansował na listę Pro, siedzi więc domyślnie na najwyższym poziomie, dlatego dół listy kosztów wygląda jak kolumna Powerhouse. Sama wartość domyślna jest opisana na liście modeli.

PlanCo daje na tanim końcu
FreeBrak puli kredytów. Tylko Whizi AI i Auto, 7 wiadomości pierwszego dnia, potem 3 dziennie
StarterCztery identyfikatory w sumie: Auto, Whizi AI, GPT-5.6 Luna, Gemini 3 Flash. Wszystkie kosztują 1 kredyt
ProStarter plus 37 kolejnych, w tym wiersze DeepSeek, Llama, Gemini Flash, Mistral i Qwen oznaczone powyżej jako Pro
PowerhouseWszystko inne w katalogu, gdzie siedzą wiersze mniejszych laboratoriów z samego dołu listy kosztów

Darmowy poziom w ogóle nie znajduje się w tym porównaniu: od 2026-09-02 daje dostęp wyłącznie do Whizi AI i Auto, więc ani najtańszy, ani najdroższy wiersz w indeksie nie jest na nim osiągalny. Daje 7 wiadomości pierwszego dnia, potem 3 dziennie, wydawanych na te dwa wiersze.

Starter jest tym wąskim. Daje dostęp do czterech identyfikatorów, każdy z nich kosztuje pojedynczy kredyt, a jego pula 400 kredytów oznacza więc 400 wiadomości. Na Starterze nie ma żadnego modelu Anthropic ani dostępu do tanich wierszy mniejszych laboratoriów z tabel powyżej.

Co kupuje jeden kredyt

Kredyt jest zdefiniowany jako jedna wiadomość na modelu domowym, który działa na bazowym modelu OpenAI przypiętym na jednym kredycie. Test przy budowaniu kończy się niepowodzeniem, jeśli którykolwiek z nich kiedykolwiek zejdzie z tego szczebla, ponieważ przesunięcie któregokolwiek przelicza na nowo całą drabinkę.

Opłata to stała liczba całkowita na identyfikator modelu. Na tym końcu katalogu oznacza to, że wiersz za 1 kredyt kosztuje jeden kredyt niezależnie od długości wejścia czy wyjścia: wklej do niego długi dokument, pozwól, by odpowiedź była długa, a tura i tak zostanie policzona jako jeden.

WierszKoszt za odpowiedźKoszt za 1000 odpowiedziKredyty
Nemotron 3.5 Lightning$0.00018$0.181
Llama 3.3 70B Instruct$0.00026$0.261
DeepSeek V4 Flash 0731$0.00028$0.281
Gemini 2.5 Flash Lite$0.0003$0.301
DeepSeek V3.2$0.000469$0.4691
Llama 4 Maverick$0.0006$0.601
GPT-5.6 Luna$0.0008$0.801
Qwen3.7 Plus$0.00096$0.961

Przeliczone na pulę, dolny szczebel to jedyne miejsce, gdzie liczba kredytów i liczba wiadomości to ta sama wartość: każda tura kosztuje jeden, więc pula planu na N kredytów to N wiadomości, dopóki zostajesz przy wierszach za 1 kredyt. Pula na plan, reset i zasada przenoszenia są opisane w materiale referencyjnym o kredytach.

Jeszcze jeden mechanizm istotny na tanim końcu: tura, która nie mieści się w pozostałym saldzie, jest odrzucana w całości, a nie rozliczana częściowo. Dwadzieścia kredytów przy trzech pozostałych kredytach zostaje odrzucone, nie przecenione. Na modelu za 1 kredyt to prawie nigdy nie ma znaczenia.

Skąd bierze się szczebel kredytowy i kiedy zastępuje go decyzja właściciela

Indeks kosztów mierzy standardową odpowiedź o 1000 tokenach wejściowych plus 500 wyjściowych względem cenników dostawców. Drabinka kredytowa jest wyprowadzona z innej tury referencyjnej: 3000 tokenów wejściowych i 800 wyjściowych, podzielonej przez to, ile ta sama tura kosztuje na modelu zakotwiczającym, czyli $0.00156 wydatku u dostawcy. Wynik jest następnie zaokrąglany w górę do dozwolonego szczebla. Drabinka zawiera osiemnaście takich szczebli: 1, 2, 3, 4, 5, 6, 8, 10, 12, 15, 20, 25, 30, 40, 50, 60, 80, 100. Czternaście niesie dziś przynajmniej jeden model, a cztery puste są utrzymywane celowo, ponieważ brakujący szczebel zaokrągliłby kolejny droższy model do tego powyżej. Zaokrąglanie zawsze idzie w górę, gdy model wypada między dwoma szczeblami.

Poza tym niektóre wiersze są przypięte decyzją właściciela, a nie wyliczeniem. Trzy przykłady widoczne w tabelach powyżej i w szerszym katalogu:

  • Rodzina Kimi jest naliczana po 10 kredytów przy realnych stawkach kosztowych 2, 3, 4 i 12 zależnie od wiersza. Dlatego dwa wiersze Moonshot leżą tuż obok siebie w dolarach, przy $0.00172 i $0.00185, a mimo to oba naliczają 10 kredytów.
  • Wiersz Gemini na Starterze jest naliczany po 1 kredycie przy realnym koszcie 2, co pozwala Starterowi zostać przy płaskiej stawce jeden kredyt za wiadomość.
  • Wiersz GPT Terra jest naliczany po 4 kredyty przy realnym koszcie 10.

Wiersze z wyszukiwaniem są wycenione zupełnie inaczej, ponieważ dostawca nalicza stałą opłatę za wyszukiwanie, która nie skaluje się ze stawką za token. Jedno wyszukiwanie za $0.005 jest warte 3.2 kredytu, więc samo wyszukiwanie kosztuje więcej niż cała wiadomość na większości katalogu. Te szczeble to progi zakładające jedno wyszukiwanie na odpowiedź.

Identyfikator modelu bez żadnego szczebla jest naliczany na szczycie drabinki, 100 kredytów, celowo: niewyceniony model powinien objawić się jako zgłoszenie do wsparcia, a nie cicho zjadać marżę. Test przy budowaniu kończy się niepowodzeniem, jeśli jakikolwiek model katalogowy lub identyfikator agenta trafi na produkcję bez szczebla.

Wreszcie wycena kredytowa jest włączana per platforma. Platforma na białej liście widzi w selektorze prawdziwe mnożniki i jest nimi obciążana z puli kredytów. Platforma, której na niej nie ma, widzi płaską stawkę jeden kredyt za turę i zachowuje starszą pulę wiadomości: 400 wiadomości miesięcznie na Starterze, 800 na Pro i 5000 na Powerhouse. Klient webowy jest dziś na systemie kredytowym.

Lista kontrolna
  • Najtaniej wyceniony wiersz w indeksie odpowiada raz za $0.000053
  • Standardowa odpowiedź to 1000 tokenów wejściowych plus 500 wyjściowych, wyceniona według stawek OpenRouter z 2026-08-20
  • Każda opłata ma dolny próg jednego kredytu, więc żadna wiadomość nie kosztuje mniej niż jeden
  • Większość najtańszych wierszy siedzi na Powerhouse, bo wszystko, czego nie ma na liście Starter ani Pro, spada do najwyższego poziomu
  • Starter daje dostęp do czterech identyfikatorów i wszystkie kosztują 1 kredyt, więc 400 kredytów to 400 wiadomości
  • Darmowe konta nie mają puli kredytów i mają dostęp do dwóch wierszy: Whizi AI i Auto
  • Szczebel kredytowy jest wyprowadzony z innej tury referencyjnej niż liczba w indeksie, a niektóre szczeble są przypięte decyzją

Najczęstsze pytania

Jaki jest najtańszy model AI w Whizi?

Pod względem kosztu za standardową odpowiedź najtaniej wyceniony wiersz w indeksie kosztów Whizi to Ling od inclusionAI za $0.000053, za nim Nex od Nex Agi, Solar Pro od Upstage i szybki poziom Qwen. Wszystkie naliczają jeden kredyt za wiadomość. Pod względem tego, co realnie płacisz, są zrównane z każdym innym wierszem za jeden kredyt, w tym z domowym modelem Whizi, bazowym modelem GPT na Starterze i kilkoma wierszami DeepSeek, Llama i Gemini.

Jaki plan potrzebuję, żeby dotrzeć do najtańszych modeli?

To zależy od wiersza. Kilka z najtańszych wierszy wymaga Powerhouse, ponieważ dostęp do modelu spada do najwyższego poziomu dla każdego identyfikatora, którego nie ma na czteroelementowej liście Starter ani 37-elementowej liście Pro. Tanie wiersze osiągalne na Pro obejmują pozycje DeepSeek, Llama, Mistral, Qwen i Gemini Flash oznaczone na tej stronie jako Pro.

Czy tańszy model zawsze kosztuje mniej kredytów?

Nie. Te dwie liczby są mierzone inaczej. Indeks wycenia standardową odpowiedź 1000 tokenów wejściowych, 500 wyjściowych względem cenników dostawców, podczas gdy szczebel kredytowy pochodzi z tury referencyjnej 3000 wejściowych, 800 wyjściowych, zaokrąglonej w górę do dozwolonego szczebla na stałej drabince, przy czym część wierszy jest przypięta decyzją powyżej lub poniżej ich wyliczenia. Dlatego wiersz za $0.0015 za odpowiedź może kosztować jeden kredyt, a wiersz za $0.000825 kosztuje dwa.

Co dzieje się z kredytem, jeśli odpowiedź zawiedzie w połowie?

Wraca. Generowanie, które zawiedzie lub zostanie przerwane, jest zwracane przez usunięcie jego wiersza zużycia, więc saldo wraca do stanu sprzed. Zwrot jest powiązany z identyfikatorem żądania nadawanym przez serwer, a nie z niczym dostarczanym przez klienta, więc zastosowanie tego samego zwrotu dwukrotnie przywraca dokładnie jedną turę, a nie dwie. Jedna rzecz nie jest zwracana: tura odrzucona z powodu przekroczenia limitu i tak zużywa swoje tokeny limitu zapytań, w przeciwnym razie klient bez kredytów mógłby próbować bez ograniczeń.

Czy mogę wypróbować tanie modele bez subskrypcji?

Nie na koncie darmowym, które daje dostęp wyłącznie do Whizi AI i Auto. Jego pula to 7 wiadomości pierwszego dnia, potem 3 dziennie, wydawanych na te dwa wiersze, a przejęcie konta gościa przenosi jego zużycie do konta zarejestrowanego, więc zaczęcie jako gość i rejestracja później nie oddaje świeżego dnia.