Llama 3.3 70B Instruct:價格、上下文視窗與點數成本

快速解答

Llama 3.3 70B Instruct的一則標準回覆(1,000個輸入token與500個輸出token)成本為$0.0003。牌價為每百萬個輸入token $0.1,每百萬個輸出token $0.32。上下文視窗為13.1萬個token,低於型錄中位數。在Whizi中,Pro方案以上每則訊息消耗1點數。

簡短答案

Llama 3.3 70B Instruct是Meta的模型,定價為每百萬個輸入token $0.1、每百萬個輸出token $0.32,上下文視窗為13.1萬個token。一則標準回覆(1,000個輸入token、500個輸出token)成本為$0.0003。在Whizi中每則訊息消耗1點數,需要Pro方案或以上。

這使它成為型錄中較便宜的模型之一:89個有定價的模型中,有79個每則回覆的成本更高,只有9個更低。

Llama 3.3 70B Instruct的價格

牌價是供應商依token計費的收費。一則標準回覆的成本是更有用的數字,因為無論每個模型的計費方式為何,它都能以相同的工作單位為所有模型定價。

每百萬個輸入token$0.1
每百萬個輸出token$0.32
一則標準回覆$0.0003
一千則回覆$0.2600
上下文視窗13.1萬token
Whizi中每則訊息消耗的點數1
Whizi最低方案Pro
89個有定價模型中的成本排名10

價格為OpenRouter所載的Meta官方牌價,最後更新於2026-08-20。涵蓋29家供應商共100個模型的完整資料集為AI模型成本指數,可自由轉載並註明出處。

在Whizi中的成本

Whizi以點數而非token來計算訊息用量,Llama 3.3 70B Instruct每則訊息收取1點數。成本不會因訊息長度或回覆長度而改變,因此一句簡短提問與一份長文件分析的成本相同。

方案每月價格每月點數此模型可用訊息數
Pro$29.99,或按年計費$19.992,0002,000
Powerhouse$49.99,或按年計費$34.998,0008,000

Llama 3.3 70B Instruct從Pro方案起即可使用。Pro是一個精選層級,而非把所有便宜的都塞進去:每個模型系列的一到兩款目前旗艦機型、各自的快速層級,以及高使用量的主力模型。詳見方案與限制

價格比較

與指數中最便宜的模型Ling-3.0-flash(每則回覆$0.000053)相比,Llama 3.3 70B Instruct的成本高出4.9倍。與中位數Kimi K2 0711($0.0017)相比,則便宜6.6倍。

它在Meta旗下最相近的模型:

模型一則回覆上下文點數
Llama 3.3 70B Instruct(本頁)$0.000313.1萬1
Llama 4 Maverick$0.0006100萬1
Muse Glimmer 30B$0.001113.1萬2
Muse Spark 1.2$0.0034100萬5

它是有定價指數中最便宜的Meta模型,因此在這家供應商內沒有更便宜的可以轉換。

實際使用中的上下文視窗

Llama 3.3 70B Instruct可接受13.1萬個token的上下文,大約相當於200頁文字。這低於有定價型錄的中位數。

宣傳的上下文與實際可用的上下文並不相同。回憶能力通常在達到標示上限之前就會開始下降,尤其是長輸入內容中段的資訊,因此實際的測試方法是上傳一份長文件,詢問其中段藏著的內容,而不是單純相信數字。

當你使用自己的檔案時,這個數字最為重要。如果文件對你選擇的模型來說太長,在同一段對話中切換到上下文範圍更大的模型可以延續對話串,不必重新開始。詳見在對話中途切換模型

操作清單
  • 輸入每百萬token $0.1,輸出每百萬token $0.32
  • 一則標準回覆$0.0003,一千則回覆$0.2600
  • 13.1萬token的上下文視窗
  • 在Whizi中每則訊息消耗1點數
  • 需要Pro方案或以上
  • 在89個有定價模型中按成本排名第10

常見問題

Llama 3.3 70B Instruct要多少錢?

牌價為每百萬個輸入token $0.1、每百萬個輸出token $0.32,換算下來一則1,000個輸入token、500個輸出token的標準回覆為$0.0003,一千則則是$0.2600。在Whizi中則是每月額度內每則訊息1點數,而非依token計費。

哪個Whizi方案包含Llama 3.3 70B Instruct?

Pro方案以上,每月$29.99,或按年計費$19.99。以每則訊息1點數計算,Pro方案2,000點數的額度若全部用在此模型上可支援2,000則訊息,大多數人會混用1點數的模型處理日常工作,讓額度用得更久。

Llama 3.3 70B Instruct的上下文視窗是多少?

13.1萬個token,大約相當於200頁文字,低於有定價型錄的中位數。請把這個數字當成上限而非實際可用值:回憶能力通常在達到標示上限之前就會開始下降,尤其是長輸入內容中段的資訊。

Llama 3.3 70B Instruct跟其他模型相比貴嗎?

它在89個有定價模型中按每則回覆成本排名第10,代表有79個模型更貴,9個更便宜。整個型錄從最便宜到最貴的價差約為2000倍,這比大多數人以為的要寬得多,所以「貴」與否只有相對於你原本會用的替代方案才有意義。