Llama 3.3 70B Instruct: precio, ventana de contexto y coste en créditos

Respuesta rápida

Llama 3.3 70B Instruct cuesta $0.0003 por una respuesta estándar, es decir 1.000 tokens de entrada y 500 de salida. Las tarifas de lista son $0.1 por millón de tokens de entrada y $0.32 por millón de tokens de salida. La ventana de contexto es de 131K tokens, por debajo de la mediana del catálogo. Dentro de Whizi cuesta 1 crédito por mensaje en el plan Pro y superiores.

La respuesta corta

Llama 3.3 70B Instruct es un modelo de Meta con un precio de $0.1 por millón de tokens de entrada y $0.32 por millón de tokens de salida, con una ventana de contexto de 131K tokens. Una respuesta estándar, es decir 1.000 tokens de entrada y 500 de salida, cuesta $0.0003. Dentro de Whizi cuesta 1 crédito por mensaje y requiere el plan Pro o superior.

Eso lo convierte en uno de los modelos más económicos del catálogo: 79 de los 89 modelos con precio cuestan más por respuesta, y 9 cuestan menos.

Cuánto cuesta Llama 3.3 70B Instruct

Las tarifas de lista son lo que cobra el proveedor por token. El coste de una respuesta estándar es el dato más útil, porque tasa la misma unidad de trabajo en todos los modelos sin importar cómo se facture cada uno.

Entrada, por millón de tokens$0.1
Salida, por millón de tokens$0.32
Una respuesta estándar$0.0003
Mil respuestas$0.2600
Ventana de contexto131K tokens
Créditos por mensaje en Whizi1
Plan mínimo de WhiziPro
Puesto por coste, de 89 modelos con precio10

Los precios son las tarifas publicadas por Meta tal como las recoge OpenRouter, actualizadas por última vez el 2026-08-20. El conjunto completo de datos, con los 100 modelos de 29 proveedores, es el índice de costes de modelos de IA, de libre reutilización con atribución.

Qué cuesta dentro de Whizi

Whizi mide los mensajes en créditos en lugar de tokens, y Llama 3.3 70B Instruct se cobra a 1 crédito por mensaje. El coste no cambia con la longitud de tu mensaje ni con la longitud de la respuesta, así que una pregunta de una línea y el análisis de un documento largo cuestan lo mismo.

PlanPrecio al mesCréditos mensualesMensajes con este modelo
Pro$29.99, o $19.99 facturado anualmente2.0002.000
Powerhouse$49.99, o $34.99 facturado anualmente8.0008.000

Llama 3.3 70B Instruct está incluido desde el plan Pro en adelante. Pro es un nivel seleccionado, no todo lo económico sin más: uno o dos modelos insignia actuales por familia, cada nivel rápido y los modelos de alto volumen. Consulta planes y límites.

Cómo se compara en precio

Frente al modelo más barato del índice, Ling-3.0-flash a $0.000053 por respuesta, Llama 3.3 70B Instruct cuesta 4,9 veces más. Frente a la mediana, Kimi K2 0711 a $0.0017, cuesta 6,6 veces menos.

Sus vecinos más cercanos de Meta:

ModeloUna respuestaContextoCréditos
Llama 3.3 70B Instruct (esta página)$0.0003131K1
Llama 4 Maverick$0.00061M1
Muse Glimmer 30B$0.0011131K2
Muse Spark 1.2$0.00341M5

Es el modelo de Meta más barato del índice con precio, así que dentro de este proveedor no hay nada a lo que bajar.

La ventana de contexto en la práctica

Llama 3.3 70B Instruct admite 131K tokens de contexto, lo que equivale aproximadamente a 200 páginas de texto. Eso está por debajo de la mediana del catálogo con precio.

El contexto anunciado y el contexto útil no son lo mismo. La capacidad de recuperar información tiende a degradarse antes de alcanzar el límite indicado, sobre todo con material en medio de una entrada larga, así que la prueba práctica es subir un documento largo y preguntar por algo enterrado a la mitad, en lugar de fiarse solo del número.

El número importa más cuando trabajas con tus propios archivos. Si un documento es demasiado largo para el modelo elegido, cambiar a un modelo con mayor contexto dentro de la misma conversación lleva el hilo consigo, así que no empiezas de cero. Consulta cambiar de modelo a mitad de conversación.

Lista de comprobación
  • Entrada $0.1 y salida $0.32 por millón de tokens
  • $0.0003 por una respuesta estándar, $0.2600 por mil
  • Ventana de contexto de 131K tokens
  • 1 crédito por mensaje dentro de Whizi
  • Requiere el plan Pro o superior
  • Puesto 10 de 89 modelos con precio, por coste

Preguntas frecuentes

¿Cuánto cuesta Llama 3.3 70B Instruct?

$0.1 por millón de tokens de entrada y $0.32 por millón de tokens de salida a precio de lista, lo que equivale a $0.0003 por una respuesta estándar de 1.000 tokens de entrada y 500 de salida, o $0.2600 por mil de ellas. Dentro de Whizi es 1 crédito por mensaje dentro de una asignación mensual, en lugar de medirse por token.

¿Qué plan de Whizi incluye Llama 3.3 70B Instruct?

Pro y superiores, que cuesta $29.99 al mes o $19.99 facturado anualmente. A 1 crédito por mensaje, una asignación Pro de 2.000 créditos cubre 2.000 mensajes con este modelo si gastas toda la asignación aquí, y la mayoría combina un modelo de 1 crédito para el trabajo habitual para que rinda más.

¿Cuál es la ventana de contexto de Llama 3.3 70B Instruct?

131K tokens, lo que equivale aproximadamente a 200 páginas de texto y queda por debajo de la mediana del catálogo con precio. Trátalo como el techo, no como la cifra de trabajo real: la capacidad de recuperar información suele degradarse antes de llegar al límite indicado, sobre todo con contenido en medio de una entrada larga.

¿Es Llama 3.3 70B Instruct caro comparado con otros modelos?

Ocupa el puesto 10 de 89 modelos con precio por coste de respuesta, así que 79 cuestan más y 9 cuestan menos. La diferencia en todo el catálogo es de unas 2000 veces entre el más barato y el más caro, un rango mucho más amplio de lo que la mayoría asume, así que "caro" solo significa algo en relación con la alternativa concreta que usarías en su lugar.