openai logo
openai

OpenAI: gpt-oss-20b

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. $0.02 per million input tokens, $0.10 per million output tokens. 131,072 token context window, maximum output of 32,768 tokens. Higher uptime with 12 providers. Includes independent benchmarks from Artificial Analysis.

Überblick

Modellspezifikationen

Kontext
131.072 tokens
Maximale Ausgabe
117.964 tokens
Architektur
text->text
Tokenizer
GPT
Wissensstand
2024-06-30
Moderiert
Nein
OPENROUTER

Vollständige Preise

Mit OpenRouter synchronisierte Preise; Tokenpreise gelten pro eine Million Token.

Eingabe
$0.02
/M tokens
Ausgabe
$0.1
/M tokens
API

Modellkonfiguration

Schlussfolgern

Moderiert
Ja
Standardparameter
medium
Fähigkeiten und Modalitäten
high, medium, low
API

Schnellstart

Dieses Modell über die OpenAI-kompatible API von OpenRouter aufrufen.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-oss-20b","messages":[{"role":"user","content":"Hello!"}]}'
Fähigkeiten und Modalitäten

EingabeAusgabe

Eingabe
text
Ausgabe
text
Schlussfolgern

Nein · high · medium · low

API

Unterstützte API-Parameter

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Verfügbare Anbieter

13 Anbieter

Live-Anbieter bei OpenRouter

Verfügbarkeit, Latenz, Durchsatz und Routing ändern sich laufend. Aktuelle Betriebsdaten stehen auf der Quellseite.

OpenRouter

Darkbloom

fp8
Kontext
131K
Maximale Ausgabe
33K
Eingabe
$0.020
Ausgabe
$0.100
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

CoreWeave

fp4
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.030
Ausgabe
$0.130
Cache-Lesen
$0.030
Cache-Schreiben
Nicht angegeben

DeepInfra

bf16
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.030
Ausgabe
$0.140
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Parasail

fp4
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.030
Ausgabe
$0.150
Cache-Lesen
$0.020
Cache-Schreiben
Nicht angegeben

Phala

unknown
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.040
Ausgabe
$0.150
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Novita

fp4
Kontext
131K
Maximale Ausgabe
33K
Eingabe
$0.040
Ausgabe
$0.150
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

SiliconFlow

fp8
Kontext
131K
Maximale Ausgabe
8K
Eingabe
$0.040
Ausgabe
$0.180
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Together

unknown
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.050
Ausgabe
$0.200
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Amazon Bedrock

unknown
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.070
Ausgabe
$0.150
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Amazon Bedrock

unknown
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.070
Ausgabe
$0.150
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Google

unknown
Kontext
131K
Maximale Ausgabe
33K
Eingabe
$0.070
Ausgabe
$0.250
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Fireworks

unknown
Kontext
131K
Maximale Ausgabe
118K
Eingabe
$0.070
Ausgabe
$0.300
Cache-Lesen
$0.035
Cache-Schreiben
Nicht angegeben

Groq

unknown
Kontext
131K
Maximale Ausgabe
66K
Eingabe
$0.075
Ausgabe
$0.300
Cache-Lesen
$0.037
Cache-Schreiben
Nicht angegeben
openai

Modelle

Alle Modelle
openai logoopenai

OpenAI: GPT Transcribe

GPT Transcribe is a high-accuracy speech-to-text model from OpenAI. It is suited for recorded audio, streamed file transcription, and committed Realtime turns, with free-form context, keyword hints, and multiple language...

Kontext
Nicht angegeben
Eingabe
audio
Ausgabe
transcription
Eingabe: $4500.00Ausgabe: Kostenlospro 1 Mio. Token
Modelldetails ansehen
openai logoopenai

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro is the same underlying model as GPT-5.6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Kontext
1.1M
Eingabe
file · image · text
Ausgabe
text
Eingabe: $0.200Ausgabe: $1.20pro 1 Mio. Token
Modelldetails ansehen
openai logoopenai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providing capable reasoning for...

Kontext
1.1M
Eingabe
file · image · text
Ausgabe
text
Eingabe: $0.200Ausgabe: $1.20pro 1 Mio. Token
Modelldetails ansehen
openai logoopenai

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro is the same underlying model as GPT-5.6 Terra, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Kontext
1.1M
Eingabe
file · image · text
Ausgabe
text
Eingabe: $2.00Ausgabe: $12.00pro 1 Mio. Token
Modelldetails ansehen