openai logo
openai

OpenAI: gpt-oss-20b (batch)

Description de la source (anglais)

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...

Présentation

Caractéristiques du modèle

Contexte
131 072 tokens
Sortie maximale
117 964 tokens
Architecture
text->text
Tokenizer
GPT
Limite des connaissances
2024-06-30
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.024
par million de tokens
Sortie
$0.112
par million de tokens
API

Configuration du modèle

Raisonnement

Raisonnement obligatoire
Oui
Paramètres par défaut
medium
Capacités et modalités
high, medium, low
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Cette requête soumet un lot asynchrone avec l’ID du modèle de base. L’ID de tâche confirme la soumission, pas la fin du traitement.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"openai/gpt-oss-20b","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacités et modalités

EntréeSortie

Entrée
text
Sortie
text
Raisonnement

Non · high · medium · low

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Fournisseurs disponibles

1 Fournisseur

Vérifié: 23 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

DeepInfra

bf16
Contexte
131K
Sortie maximale
118K
Entrée
$0.024
Sortie
$0.112
Lecture du cache
Non indiqué
Écriture du cache
Non indiqué
openai

4 modèles

Tous les modèles
openai logoopenai

OpenAI: GPT-6 Luna Pro

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexte
1.1M
Entrée
file · image · text
Sortie
text
Entrée: $0.1Sortie: $0.5par million de tokens
Voir la fiche du modèle
openai logoopenai

OpenAI: GPT-6 Luna Pro (batch)

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexte
1.1M
Entrée
file · image · text
Sortie
text
Entrée: $0.05Sortie: $0.25par million de tokens
Voir la fiche du modèle
openai logoopenai

OpenAI: GPT-6 Luna

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexte
1.1M
Entrée
file · image · text
Sortie
text
Entrée: $0.1Sortie: $0.5par million de tokens
Voir la fiche du modèle
openai logoopenai

OpenAI: GPT-6 Luna (batch)

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexte
1.1M
Entrée
file · image · text
Sortie
text
Entrée: $0.05Sortie: $0.25par million de tokens
Voir la fiche du modèle