openai logo
openai

OpenAI: gpt-oss-20b

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. $0.02 per million input tokens, $0.10 per million output tokens. 131,072 token context window, maximum output of 32,768 tokens. Higher uptime with 12 providers. Includes independent benchmarks from Artificial Analysis.

模型概览

模型规格

上下文
131,072 tokens
最大输出
117,964 tokens
架构
text->text
分词器
GPT
知识截止时间
2024-06-30
内容审核
OPENROUTER

完整价格

同步自 OpenRouter。Token 价格均按每百万 Token 展示。

输入
$0.02
/M tokens
输出
$0.1
/M tokens
API

模型配置

推理能力

内容审核
默认参数
medium
能力与模态
high, medium, low
API

快速调用

通过 OpenRouter 的 OpenAI 兼容 API 调用这个确切的模型 ID。

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-oss-20b","messages":[{"role":"user","content":"Hello!"}]}'
能力与模态

输入输出

输入
text
输出
text
推理能力

· high · medium · low

API

支持的 API 参数

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
可用提供方

13 个提供方

在 OpenRouter 查看实时 Provider

Provider 可用性、延迟、吞吐量和路由会持续变化,请前往来源页面查看实时运行数据。

OpenRouter

Darkbloom

fp8
上下文
131K
最大输出
33K
输入
$0.020
输出
$0.100
缓存读取
暂未提供
缓存写入
暂未提供

CoreWeave

fp4
上下文
131K
最大输出
118K
输入
$0.030
输出
$0.130
缓存读取
$0.030
缓存写入
暂未提供

DeepInfra

bf16
上下文
131K
最大输出
118K
输入
$0.030
输出
$0.140
缓存读取
暂未提供
缓存写入
暂未提供

Parasail

fp4
上下文
131K
最大输出
118K
输入
$0.030
输出
$0.150
缓存读取
$0.020
缓存写入
暂未提供

Phala

unknown
上下文
131K
最大输出
118K
输入
$0.040
输出
$0.150
缓存读取
暂未提供
缓存写入
暂未提供

Novita

fp4
上下文
131K
最大输出
33K
输入
$0.040
输出
$0.150
缓存读取
暂未提供
缓存写入
暂未提供

SiliconFlow

fp8
上下文
131K
最大输出
8K
输入
$0.040
输出
$0.180
缓存读取
暂未提供
缓存写入
暂未提供

Together

unknown
上下文
131K
最大输出
118K
输入
$0.050
输出
$0.200
缓存读取
暂未提供
缓存写入
暂未提供

Amazon Bedrock

unknown
上下文
131K
最大输出
118K
输入
$0.070
输出
$0.150
缓存读取
暂未提供
缓存写入
暂未提供

Amazon Bedrock

unknown
上下文
131K
最大输出
118K
输入
$0.070
输出
$0.150
缓存读取
暂未提供
缓存写入
暂未提供

Google

unknown
上下文
131K
最大输出
33K
输入
$0.070
输出
$0.250
缓存读取
暂未提供
缓存写入
暂未提供

Fireworks

unknown
上下文
131K
最大输出
118K
输入
$0.070
输出
$0.300
缓存读取
$0.035
缓存写入
暂未提供

Groq

unknown
上下文
131K
最大输出
66K
输入
$0.075
输出
$0.300
缓存读取
$0.037
缓存写入
暂未提供
openai

个模型

全部模型
openai logoopenai

OpenAI: GPT Transcribe

GPT Transcribe is a high-accuracy speech-to-text model from OpenAI. It is suited for recorded audio, streamed file transcription, and committed Realtime turns, with free-form context, keyword hints, and multiple language...

上下文
暂未提供
输入
audio
输出
transcription
输入: $4500.00输出: 免费每百万 Token
查看模型详情
openai logoopenai

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro is the same underlying model as GPT-5.6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

上下文
1.1M
输入
file · image · text
输出
text
输入: $0.200输出: $1.20每百万 Token
查看模型详情
openai logoopenai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providing capable reasoning for...

上下文
1.1M
输入
file · image · text
输出
text
输入: $0.200输出: $1.20每百万 Token
查看模型详情
openai logoopenai

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro is the same underlying model as GPT-5.6 Terra, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

上下文
1.1M
输入
file · image · text
输出
text
输入: $2.00输出: $12.00每百万 Token
查看模型详情