meta-llama logo
meta-llama

Meta: Llama 3.3 70B Instruct

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). $0.10 per million input tokens, $0.32 per million output tokens. 131,072 token context window, maximum output of 16,384 tokens. Higher uptime with 12 providers. Includes independent benchmarks from Artificial Analysis.

Visão geral

Especificações do modelo

Contexto
131.072 tokens
Saída máxima
115.200 tokens
Arquitetura
text->text
Tokenizador
Llama3
Limite de conhecimento
2023-12-31
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.1
/M tokens
Saída
$0.32
/M tokens
API

Início rápido

Use este modelo pela API compatível com OpenAI do OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-3.3-70b-instruct","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
API

Parâmetros de API compatíveis

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

13 provedores

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

DeepInfra

fp8
Contexto
131K
Saída máxima
16K
Entrada
$0.100
Saída
$0.320
Leitura de cache
Não informado
Gravação de cache
Não informado

Nebius

fp8
Contexto
131K
Saída máxima
118K
Entrada
$0.130
Saída
$0.400
Leitura de cache
Não informado
Gravação de cache
Não informado

Novita

bf16
Contexto
12K
Saída máxima
11K
Entrada
$0.135
Saída
$0.400
Leitura de cache
Não informado
Gravação de cache
Não informado

AkashML

fp8
Contexto
131K
Saída máxima
128K
Entrada
$0.200
Saída
$0.520
Leitura de cache
$0.100
Gravação de cache
Não informado

Parasail

fp8
Contexto
131K
Saída máxima
16K
Entrada
$0.220
Saída
$0.500
Leitura de cache
$0.110
Gravação de cache
Não informado

Crusoe

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.250
Saída
$0.750
Leitura de cache
$0.130
Gravação de cache
Não informado

Cloudflare

fp8
Contexto
24K
Saída máxima
22K
Entrada
$0.293
Saída
$2.25
Leitura de cache
Não informado
Gravação de cache
Não informado

SambaNova

unknown
Contexto
131K
Saída máxima
3K
Entrada
$0.450
Saída
$0.900
Leitura de cache
Não informado
Gravação de cache
Não informado

Groq

unknown
Contexto
131K
Saída máxima
33K
Entrada
$0.590
Saída
$0.790
Leitura de cache
$0.295
Gravação de cache
Não informado

CoreWeave

fp16
Contexto
128K
Saída máxima
115K
Entrada
$0.710
Saída
$0.710
Leitura de cache
$0.710
Gravação de cache
Não informado

Google

unknown
Contexto
128K
Saída máxima
8K
Entrada
$0.720
Saída
$0.720
Leitura de cache
Não informado
Gravação de cache
Não informado

Google

unknown
Contexto
128K
Saída máxima
115K
Entrada
$0.720
Saída
$0.720
Leitura de cache
Não informado
Gravação de cache
Não informado

Together

unknown
Contexto
131K
Saída máxima
2K
Entrada
$1.04
Saída
$1.04
Leitura de cache
Não informado
Gravação de cache
Não informado
meta-llama

modelos

Todos os modelos
meta-llama logometa-llama

Meta: Llama Guard 4 12B

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Contexto
164K
Entrada
image · text
Saída
text
Entrada: $0.180Saída: $0.180por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 4 Maverick

Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forward...

Contexto
1.0M
Entrada
text · image
Saída
text
Entrada: $0.200Saída: $0.696por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 4 Scout

Llama 4 Scout 17B Instruct (16E) is a mixture-of-experts (MoE) language model developed by Meta, activating 17 billion parameters out of a total of 109B. It supports native multimodal input...

Contexto
1.3M
Entrada
text · image
Saída
text
Entrada: $0.110Saída: $0.340por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 3.2 1B Instruct

Llama 3.2 1B is a 1-billion-parameter language model focused on efficiently performing natural language tasks, such as summarization, dialogue, and multilingual text analysis. Its smaller size allows it to operate...

Contexto
60K
Entrada
text
Saída
text
Entrada: $0.027Saída: $0.201por milhão de tokens
Ver detalhes do modelo