meta-llama logo
meta-llama

Meta: Llama 4 Scout

Descrição da fonte (inglês)

Llama 4 Scout 17B Instruct (16E) is a mixture-of-experts (MoE) language model developed by Meta, activating 17 billion parameters out of a total of 109B. It supports native multimodal input...

Visão geral

Especificações do modelo

Contexto
1.310.720 tokens
Saída máxima
16.384 tokens
Arquitetura
text+image->text
Tokenizador
Llama4
Limite de conhecimento
2024-08-31
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.1
por milhão de tokens
Saída
$0.3
por milhão de tokens
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"meta-llama/llama-4-scout","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
textimage
Saída
text
API

Parâmetros de API compatíveis

frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Provedores disponíveis

3 provedores

Verificado: 7 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

DeepInfra

fp8
Contexto
328K
Saída máxima
16K
Entrada
$0.1
Saída
$0.3
Leitura de cache
Não informado
Gravação de cache
Não informado

Novita

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.18
Saída
$0.59
Leitura de cache
Não informado
Gravação de cache
Não informado

Google

Não informado
Contexto
1.3M
Saída máxima
8K
Entrada
$0.25
Saída
$0.7
Leitura de cache
Não informado
Gravação de cache
Não informado
meta-llama

4 modelos

Todos os modelos
meta-llama logometa-llama

Meta: Llama Guard 4 12B

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Contexto
164K
Entrada
image · text
Saída
text
Entrada: $0.18Saída: $0.18por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 4 Maverick

Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forward...

Contexto
1.0M
Entrada
text · image
Saída
text
Entrada: $0.1875Saída: $0.6525por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 3.3 70B Instruct

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). The Llama 3.3 instruction tuned text only model...

Contexto
131K
Entrada
text
Saída
text
Entrada: $0.1Saída: $0.32por milhão de tokens
Ver detalhes do modelo
meta-llama logometa-llama

Meta: Llama 3.2 1B Instruct

Llama 3.2 1B is a 1-billion-parameter language model focused on efficiently performing natural language tasks, such as summarization, dialogue, and multilingual text analysis. Its smaller size allows it to operate...

Contexto
60K
Entrada
text
Saída
text
Entrada: $0.027Saída: $0.201por milhão de tokens
Ver detalhes do modelo