Jawapan ringkas
Ya, Whizi menyediakan keluarga Llama daripada Meta dalam katalog 280+ modelnya, dan ketiga-tiga baris Llama dalam set Pro berada pada tangga termurah yang diukur oleh Whizi: 1 kredit setiap mesej. Llama berada pada pelan Pro, iaitu $29.99/bulan, atau $19.99/bulan jika dibilkan setahun sekali pada $239.88. Starter tidak menyertakan sebarang model Llama.
Baris Llama yang diberi harga oleh Whizi, dengan kos kredit yang dikenakan setiap mesej:
| Model | Tetingkap konteks | Kos setiap jawapan standard | Kredit setiap mesej | Pelan minimum |
|---|---|---|---|---|
| Llama 4 Maverick | 1M | $0.0006 | 1 | Pro |
| Llama 3.3 70B Instruct | 131K | $0.00026 | 1 | Pro |
| Llama 4 Scout | Tidak disenaraikan dalam Cost Index | Tidak disenaraikan dalam Cost Index | 1 | Pro |
Jawapan standard ialah 1,000 token input ditambah 500 token output, diberi harga berdasarkan kadar yang dibaca pada 2026-08-20, jadi angka ini setanding secara adil merentasi penyedia.
Ketiga-tiga pengecam ini ialah baris Llama yang dinamakan dalam set model Pro. Sebarang pengecam Llama lain yang dibawa oleh katalog akan jatuh kepada Powerhouse sebagai gantian seperti diterangkan di bawah, jadi anggap jadual ini sebagai senarai Pro, bukan senarai lengkap katalog.
Berapa kos mesej Llama dalam kredit
Ketiga-tiga baris Llama dalam set Pro berada pada tangga terendah dalam skala kredit, jadi setiap giliran Llama dikenakan 1 kredit tidak kira apa yang anda hantar. Pengecam ketiga, Llama 4 Scout, tidak disenaraikan dalam Cost Index, jadi jadual tidak menerbitkan tetingkap atau harga setiap jawapan untuknya, tetapi jadual kredit tetap mengenakan 1 kredit sepertimana dua yang lain.
Pada kadar 1 kredit setiap mesej, peruntukan kredit sebenarnya ialah bilangan mesej Llama: di web, Pro membeli 2,000 giliran Llama sebulan dan Powerhouse membeli 8,000. Starter langsung tidak mencapai mana-mana baris Llama.
| Pelan | Kredit sebulan (web) | Mesej sebulan di luar senarai benar kredit |
|---|---|---|
| Starter | 400 | 400 |
| Pro | 2,000 | 800 |
| Powerhouse | 8,000 | 5,000 |
Pengebilan mingguan hanya ditawarkan pada mudah alih, dan tidak pada setiap tingkat. Di mana ia dijual, peruntukan kredit mingguan ialah 100 pada Starter dan 500 pada Pro, dan peruntukan mesej mingguan ialah 100 dan 400.
Setiap giliran dikenakan caj pada tangga model yang menjawabnya, jadi perbualan yang beralih antara keluarga model dikenakan bil setiap giliran mengikut kadar model yang menjawab pada ketika itu. Kredit tidak dibawa maju: baki menjumlahkan penggunaan dalam kunci tempoh semasa, jadi ketibaan tempoh baharu itu sendiri adalah tetapan semula. Tiada cara untuk menambah nilai.
Pengganda kredit hanya dikenakan pada platform yang berada dalam senarai benar kredit, iaitu aplikasi web pada masa ini. Platform di luar senarai benar itu melihat kadar tetap 1x, dikenakan satu setiap giliran, dan sebaliknya mengekalkan peruntukan mesej yang lama. Pada Starter, kedua-dua peruntukan itu adalah angka yang sama, 400. Pada Pro dan Powerhouse, ia berbeza, iaitu lajur kedua dan ketiga dalam jadual di atas.
Skala penuh, semua empat belas tangga yang diisi, terdapat dalam rujukan kredit.
Pintu pagar pelan, secara tepat
Akses ditentukan di bahagian pelayan mengikut pengecam (lihat rujukan model).
Starter hanya mencapai tepat empat entri pemilih: Auto, Whizi AI, satu model OpenAI dan satu model Google. Tiada baris Llama antaranya.
Pro menambah set Llama di atas Starter. Dibaca sebagai peraturan kurasi yang dikenakan pada satu keluarga, set itu ialah baris Llama 4 semasa ditambah model kuda beban Llama 3 yang lebih lama, tiga pengecam kesemuanya.
Powerhouse menyertakan segala yang dicapai oleh Pro, kerana kedudukan tingkat dibandingkan menggunakan ujian lebih besar daripada atau sama dengan, jadi tingkat yang lebih tinggi sentiasa memenuhi keperluan yang lebih rendah. Powerhouse juga tempat sebarang pengecam katalog mendarat jika ia tidak dinamakan dalam set Starter atau Pro, itulah sebabnya pengecam Llama yang tidak disenaraikan tergolong dalam Powerhouse sehingga ia dinaik taraf secara sengaja.
Memilih model di atas tingkat anda memulangkan HTTP 403 dengan kod tier_upgrade_required dan mesej "Upgrade your plan to use this model." Gejala itu diterangkan dalam apabila model tidak tersedia.
Akaun percuma tidak mencapai mana-mana baris Llama: sejak 2026-09-02, tingkat percuma membuka Whizi AI dan Auto sahaja. Peruntukan kredit percuma ialah 0, dan peruntukan mesej ialah 7 mesej pada hari pertama, kemudian 3 sehari, digunakan pada kedua-dua baris itu.
Tetingkap konteks berbanding apa yang sebenarnya diperoleh setiap giliran
Tetingkap konteks dalam jadual di atas ialah tetingkap yang diterbitkan oleh model. Ia bukan bajet yang digunakan oleh satu giliran Whizi.
Setiap model dalam katalog mendapat bajet tetap sebanyak 40,000 token input dan 20,000 token output setiap giliran. Model yang tetingkapnya berada di bawah 93,000 token pula mendapat bajet berkadar yang lebih kecil, dengan output dihadkan pada 40 peratus daripada tetingkap dan margin keselamatan 1,000 token ditahan.
Oleh sebab kedua-dua baris Llama yang diberi harga berada di atas ambang 93,000 token, kedua-duanya berjalan pada bajet tetap yang sama iaitu 40,000 input dan 20,000 output. Tetingkap yang diterbitkan lebih besar tidak menambah apa yang dihantar oleh satu giliran Whizi, dan penyedia mengira output maksimum yang diminta terhadap tetingkap sama seperti input, jadi baris 1M dan baris 131K bersaiz sama di sini. Jika satu bebenang melebihi bajet itu, lihat apabila perbualan terlalu panjang.
Kedudukan baris ini dalam Cost Index
Cost Index memberi harga kepada 100 baris merentasi 29 penyedia pada satu jawapan standard setiap satu. Angka itu ialah saiz indeks harga, bukan saiz katalog Whizi.
| Titik rujukan | Kos setiap jawapan standard |
|---|---|
| Baris termurah dalam indeks | $0.000053 |
| Baris median | $0.00185 |
| Llama 3.3 70B Instruct | $0.00026 |
| Llama 4 Maverick | $0.0006 |
| Baris termahal dalam indeks | $0.105 |
Kedua-dua baris Llama yang diberi harga berada di bawah median indeks, dan jurang antara baris termurah dan termahal yang diberi harga adalah lebih kurang 2000x. 89 daripada 100 baris yang diberi harga dikenakan caj kredit Whizi; selebihnya diberi harga untuk perbandingan sahaja dan tidak ditawarkan sebagai baris terukur tersendiri.
Kegunaan yang tidak disokong oleh Llama dalam Whizi
Tiada baris Llama pada tangga Auto. Auto mempunyai enam tangga, dan model pada tangga itu ialah model dalaman untuk soalan pendek, baris Gemini Flash untuk penulisan semula dan juga untuk lampiran, baris GPT untuk bentuk panjang, baris Claude Sonnet untuk kod dan baris GPT kedua untuk penaakulan berbilang langkah. Tiada pengecam Llama muncul pada mana-mana daripada keenam-enam itu, jadi Auto tidak dapat mencapai Llama pada mana-mana tingkat dan jawapan Llama sentiasa merupakan pilihan manual dalam pemilih model.
Lampiran pada Auto pergi ke tempat lain. Auto menghalakan mana-mana giliran yang membawa lampiran kepada Gemini Flash, atas alasan bahawa imej memerlukan penglihatan dan bukannya tetingkap yang besar. Pilih sendiri baris Llama dan lampiran itu dikendalikan mengikut setiap permintaan dan bukannya mengikut model. Pada aplikasi, ia dihalakan kepada model mana sekalipun yang sedang digunakan oleh giliran itu, dan hanya mesej pengguna paling terkini yang membawa lampiran dihalakan. Pada web, fail PDF, Word atau hamparan mempunyai teksnya diekstrak dalam pelayar dan teks itulah yang sampai kepada model.
Penjanaan suara dan media bukan pilihan mengikut model. Penjana media melangkau sepenuhnya pintu pagar mengikut model dan sebaliknya bertingkat mengikut bahagian pemilih, dan mod suara berjalan pada laluan masa nyata tersendiri, jadi memilih baris Llama tidak mengubah kedua-duanya.
Whizi tidak menerbitkan sokongan penglihatan mengikut model. Tiada penanda keupayaan penglihatan atau multimodal di mana-mana dalam katalog atau cost index, jadi Whizi tidak dapat memberitahu anda baris Llama mana yang boleh membaca imej. Bahagian imej dihalakan kepada model mana sekalipun yang sedang digunakan oleh giliran itu dan hasilnya adalah antara anda dengan model itu.
- Llama terdapat dalam katalog dan ketiga-tiga baris set Pro dikenakan 1 kredit setiap mesej
- Pro ialah pelan yang membuka set Llama, dan Powerhouse turut menyertakannya
- Starter tidak menyertakan sebarang model Llama
- Akaun percuma tidak mencapai mana-mana baris Llama: Pro ialah pelan paling rendah yang mencapainya
- Setiap giliran Llama berjalan pada bajet tetap 40,000 token input dan 20,000 token output, kerana kedua-dua baris yang diberi harga berada di atas ambang 93,000 token
- Tiada baris Llama pada mana-mana daripada enam tangga Auto, jadi Llama sentiasa merupakan pilihan manual
- Whizi tidak menerbitkan penanda penglihatan mengikut model, jadi ia tidak dapat memberitahu anda baris Llama mana yang boleh membaca imej
Soalan Lazim
Model Llama apakah yang disertakan oleh Whizi?
Set model Pro menamakan tiga pengecam Llama: dua varian Llama 4 ditambah kuda beban Llama 3, dan ketiga-tiganya dikenakan 1 kredit setiap mesej. Dua daripadanya diberi harga dalam Cost Index Whizi, dengan tetingkap konteks yang diterbitkan sebanyak 1M dan 131K. Katalog mungkin membawa pengecam Llama tambahan, dan apa-apa yang tidak dinamakan dalam set Starter atau Pro memerlukan Powerhouse.
Berapa banyak kredit yang dikenakan untuk satu mesej Llama?
Satu kredit, iaitu tangga terendah dalam skala dan sama seperti satu mesej pada model dalaman Whizi. Sama ada Starter atau percuma langsung tidak membuka mana-mana baris Llama, jadi Pro ialah pelan pertama yang membolehkan 1 kredit itu membeli sesuatu di sini.
Adakah saya perlu pelan paling atas untuk menggunakan Llama?
Tidak. Pro ialah pelan termurah yang membuka baris Llama, pada $29.99/bulan. Starter tidak mencapainya, Powerhouse hanya diperlukan untuk pengecam Llama yang tidak dinamakan dalam set Pro, dan akaun percuma tidak mencapai mana-mana daripadanya: ia menjalankan Whizi AI dan Auto sahaja.
Bolehkah saya menukar perbualan daripada Llama kepada model lain?
Ya. Setiap giliran dikenakan caj pada tangga model yang menjawabnya, jadi bebenang yang beralih antara keluarga model dikenakan bil setiap giliran mengikut kadar masing-masing dan bukannya pada peringkat bebenang. Sesuatu model tidak pernah keluar daripada katalog sebaik sahaja ia ditawarkan, kerana sesuatu perbualan membawa model yang menciptanya, jadi bebenang Llama lama masih boleh dibuka kemudian. Mekanismenya terdapat dalam menukar model di tengah perbualan.
Apakah yang boleh saya lampirkan pada giliran Llama?
Lampiran dikendalikan mengikut setiap permintaan dan bukannya mengikut model, dan ia tidak mengenakan sebarang kredit tersendiri. Hadnya ialah 10 MB setiap fail, 4 lampiran setiap gesaan dan 20 MB secara keseluruhan setiap gesaan. Jenis yang diterima ialah JPEG, PNG, WebP, GIF, PDF, teks biasa, Markdown, CSV dan JSON.
Adakah carian web berfungsi dengan Llama?
Whizi tidak menerbitkan senarai carian web mengikut model. Carian ialah togol mengikut setiap permintaan dengan tiga mod, off, probe dan native, dan bukannya penanda keupayaan mengikut model, dan matriks mengikut model itu tidak pernah disenaraikan, jadi tiada jawapan khusus untuk Llama yang boleh diberikan. Togol itu sendiri diterangkan dalam carian web.