openai logo
openai

OpenAI: gpt-oss-20b

Descrição da fonte (inglês)

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...

Visão geral

Especificações do modelo

Contexto
131.072 tokens
Saída máxima
32.768 tokens
Arquitetura
text->text
Tokenizador
GPT
Limite de conhecimento
2024-06-30
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.018
por milhão de tokens
Saída
$0.09
por milhão de tokens
API

Configuração do modelo

Raciocínio

Raciocínio obrigatório
Sim
Parâmetros padrão
medium
Recursos e modalidades
high, medium, low
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-oss-20b","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
Raciocínio

Não · high · medium · low

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

12 provedores

Verificado: 23 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Darkbloom

fp8
Contexto
131K
Saída máxima
33K
Entrada
$0.018
Saída
$0.09
Leitura de cache
Não informado
Gravação de cache
Não informado

AkashML

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.02
Saída
$0.1
Leitura de cache
Não informado
Gravação de cache
Não informado

DekaLLM

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.029
Saída
$0.14
Leitura de cache
Não informado
Gravação de cache
Não informado

CoreWeave

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.13
Leitura de cache
$0.03
Gravação de cache
Não informado

DeepInfra

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.14
Leitura de cache
Não informado
Gravação de cache
Não informado

Parasail

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.15
Leitura de cache
$0.02
Gravação de cache
Não informado

Novita

fp4
Contexto
131K
Saída máxima
33K
Entrada
$0.04
Saída
$0.15
Leitura de cache
Não informado
Gravação de cache
Não informado

SiliconFlow

fp8
Contexto
131K
Saída máxima
8K
Entrada
$0.04
Saída
$0.18
Leitura de cache
Não informado
Gravação de cache
Não informado

Amazon Bedrock

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.07
Saída
$0.15
Leitura de cache
Não informado
Gravação de cache
Não informado

Amazon Bedrock

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.07
Saída
$0.15
Leitura de cache
Não informado
Gravação de cache
Não informado

Google

Não informado
Contexto
131K
Saída máxima
33K
Entrada
$0.07
Saída
$0.25
Leitura de cache
Não informado
Gravação de cache
Não informado

Groq

Não informado
Contexto
131K
Saída máxima
66K
Entrada
$0.075
Saída
$0.3
Leitura de cache
$0.0375
Gravação de cache
Não informado
openai

4 modelos

Todos os modelos
openai logoopenai

OpenAI: GPT-6 Luna Pro

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.1Saída: $0.5por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna Pro (batch)

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.05Saída: $0.25por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.1Saída: $0.5por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna (batch)

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.05Saída: $0.25por milhão de tokens
Ver detalhes do modelo