openai logo
openai

OpenAI: gpt-oss-120b

Descrição da fonte (inglês)

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward pass and is optimized...

Visão geral

Especificações do modelo

Contexto
131.072 tokens
Saída máxima
65.536 tokens
Arquitetura
text->text
Tokenizador
GPT
Limite de conhecimento
2024-06-30
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.15
por milhão de tokens
Saída
$0.6
por milhão de tokens
Leitura de cache
$0.075
por milhão de tokens
API

Configuração do modelo

Raciocínio

Raciocínio obrigatório
Sim
Parâmetros padrão
medium
Recursos e modalidades
high, medium, low
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-oss-120b","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
Raciocínio

Não · high · medium · low

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p
Provedores disponíveis

24 provedores

Verificado: 18 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

AkashML

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.17
Leitura de cache
$0.03
Gravação de cache
Não informado

CoreWeave

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.17
Leitura de cache
$0.03
Gravação de cache
Não informado

DekaLLM

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.03
Saída
$0.18
Leitura de cache
Não informado
Gravação de cache
Não informado

DeepInfra

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.037
Saída
$0.17
Leitura de cache
Não informado
Gravação de cache
Não informado

Crusoe

bf16
Contexto
131K
Saída máxima
118K
Entrada
$0.05
Saída
$0.25
Leitura de cache
$0.05
Gravação de cache
Não informado

Novita

fp4
Contexto
131K
Saída máxima
33K
Entrada
$0.05
Saída
$0.25
Leitura de cache
Não informado
Gravação de cache
Não informado

Mancer 2

fp8
Contexto
131K
Saída máxima
118K
Entrada
$0.05
Saída
$0.3
Leitura de cache
Não informado
Gravação de cache
Não informado

DigitalOcean

Não informado
Contexto
128K
Saída máxima
4K
Entrada
$0.06
Saída
$0.42
Leitura de cache
$0.012
Gravação de cache
Não informado

Google

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.09
Saída
$0.36
Leitura de cache
Não informado
Gravação de cache
Não informado

BaseTen

fp4
Contexto
128K
Saída máxima
115K
Entrada
$0.1
Saída
$0.5
Leitura de cache
$0.1
Gravação de cache
Não informado

BaseTen

fp4
Contexto
128K
Saída máxima
115K
Entrada
$0.1
Saída
$0.5
Leitura de cache
$0.1
Gravação de cache
Não informado

Parasail

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.1
Saída
$0.75
Leitura de cache
$0.055
Gravação de cache
Não informado

SambaNova

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.14
Saída
$0.95
Leitura de cache
Não informado
Gravação de cache
Não informado

Amazon Bedrock

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

Nebius

fp4
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

Amazon Bedrock

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

DeepInfra

bf16
Contexto
131K
Saída máxima
16K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

SiliconFlow

fp8
Contexto
131K
Saída máxima
8K
Entrada
$0.15
Saída
$0.6
Leitura de cache
$0.075
Gravação de cache
Não informado

Phala

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

Together

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.6
Leitura de cache
Não informado
Gravação de cache
Não informado

Groq

Não informado
Contexto
131K
Saída máxima
66K
Entrada
$0.15
Saída
$0.6
Leitura de cache
$0.075
Gravação de cache
Não informado

Mara

Não informado
Contexto
131K
Saída máxima
118K
Entrada
$0.15
Saída
$0.75
Leitura de cache
Não informado
Gravação de cache
Não informado

DeepInfra

fp8
Contexto
131K
Saída máxima
118K
Entrada
$0.2
Saída
$0.95
Leitura de cache
Não informado
Gravação de cache
Não informado

Cerebras

fp16
Contexto
131K
Saída máxima
41K
Entrada
$0.35
Saída
$0.75
Leitura de cache
$0.35
Gravação de cache
Não informado
openai

4 modelos

Todos os modelos
openai logoopenai

OpenAI: GPT-6 Luna Pro

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.1Saída: $0.5por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna Pro (batch)

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.05Saída: $0.25por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.1Saída: $0.5por milhão de tokens
Ver detalhes do modelo
openai logoopenai

OpenAI: GPT-6 Luna (batch)

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Saída
text
Entrada: $0.05Saída: $0.25por milhão de tokens
Ver detalhes do modelo