簡短答案
Llama 3.3 70B Instruct是Meta的模型,定價為每百萬個輸入token $0.1、每百萬個輸出token $0.32,上下文視窗為13.1萬個token。一則標準回覆(1,000個輸入token、500個輸出token)成本為$0.0003。在Whizi中每則訊息消耗1點數,需要Pro方案或以上。
這使它成為型錄中較便宜的模型之一:89個有定價的模型中,有79個每則回覆的成本更高,只有9個更低。
Llama 3.3 70B Instruct的價格
牌價是供應商依token計費的收費。一則標準回覆的成本是更有用的數字,因為無論每個模型的計費方式為何,它都能以相同的工作單位為所有模型定價。
| 每百萬個輸入token | $0.1 |
| 每百萬個輸出token | $0.32 |
| 一則標準回覆 | $0.0003 |
| 一千則回覆 | $0.2600 |
| 上下文視窗 | 13.1萬token |
| Whizi中每則訊息消耗的點數 | 1 |
| Whizi最低方案 | Pro |
| 89個有定價模型中的成本排名 | 10 |
價格為OpenRouter所載的Meta官方牌價,最後更新於2026-08-20。涵蓋29家供應商共100個模型的完整資料集為AI模型成本指數,可自由轉載並註明出處。
在Whizi中的成本
Whizi以點數而非token來計算訊息用量,Llama 3.3 70B Instruct每則訊息收取1點數。成本不會因訊息長度或回覆長度而改變,因此一句簡短提問與一份長文件分析的成本相同。
| 方案 | 每月價格 | 每月點數 | 此模型可用訊息數 |
|---|---|---|---|
| Pro | $29.99,或按年計費$19.99 | 2,000 | 2,000 |
| Powerhouse | $49.99,或按年計費$34.99 | 8,000 | 8,000 |
Llama 3.3 70B Instruct從Pro方案起即可使用。Pro是一個精選層級,而非把所有便宜的都塞進去:每個模型系列的一到兩款目前旗艦機型、各自的快速層級,以及高使用量的主力模型。詳見方案與限制。
價格比較
與指數中最便宜的模型Ling-3.0-flash(每則回覆$0.000053)相比,Llama 3.3 70B Instruct的成本高出4.9倍。與中位數Kimi K2 0711($0.0017)相比,則便宜6.6倍。
它在Meta旗下最相近的模型:
| 模型 | 一則回覆 | 上下文 | 點數 |
|---|---|---|---|
| Llama 3.3 70B Instruct(本頁) | $0.0003 | 13.1萬 | 1 |
| Llama 4 Maverick | $0.0006 | 100萬 | 1 |
| Muse Glimmer 30B | $0.0011 | 13.1萬 | 2 |
| Muse Spark 1.2 | $0.0034 | 100萬 | 5 |
它是有定價指數中最便宜的Meta模型,因此在這家供應商內沒有更便宜的可以轉換。
實際使用中的上下文視窗
Llama 3.3 70B Instruct可接受13.1萬個token的上下文,大約相當於200頁文字。這低於有定價型錄的中位數。
宣傳的上下文與實際可用的上下文並不相同。回憶能力通常在達到標示上限之前就會開始下降,尤其是長輸入內容中段的資訊,因此實際的測試方法是上傳一份長文件,詢問其中段藏著的內容,而不是單純相信數字。
當你使用自己的檔案時,這個數字最為重要。如果文件對你選擇的模型來說太長,在同一段對話中切換到上下文範圍更大的模型可以延續對話串,不必重新開始。詳見在對話中途切換模型。
- 輸入每百萬token $0.1,輸出每百萬token $0.32
- 一則標準回覆$0.0003,一千則回覆$0.2600
- 13.1萬token的上下文視窗
- 在Whizi中每則訊息消耗1點數
- 需要Pro方案或以上
- 在89個有定價模型中按成本排名第10
常見問題
Llama 3.3 70B Instruct要多少錢?
牌價為每百萬個輸入token $0.1、每百萬個輸出token $0.32,換算下來一則1,000個輸入token、500個輸出token的標準回覆為$0.0003,一千則則是$0.2600。在Whizi中則是每月額度內每則訊息1點數,而非依token計費。
哪個Whizi方案包含Llama 3.3 70B Instruct?
Pro方案以上,每月$29.99,或按年計費$19.99。以每則訊息1點數計算,Pro方案2,000點數的額度若全部用在此模型上可支援2,000則訊息,大多數人會混用1點數的模型處理日常工作,讓額度用得更久。
Llama 3.3 70B Instruct的上下文視窗是多少?
13.1萬個token,大約相當於200頁文字,低於有定價型錄的中位數。請把這個數字當成上限而非實際可用值:回憶能力通常在達到標示上限之前就會開始下降,尤其是長輸入內容中段的資訊。
Llama 3.3 70B Instruct跟其他模型相比貴嗎?
它在89個有定價模型中按每則回覆成本排名第10,代表有79個模型更貴,9個更便宜。整個型錄從最便宜到最貴的價差約為2000倍,這比大多數人以為的要寬得多,所以「貴」與否只有相對於你原本會用的替代方案才有意義。