openai logo
openai

OpenAI: gpt-oss-20b (batch)

Descripción de la fuente (inglés)

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...

Resumen

Especificaciones del modelo

Contexto
131.072 tokens
Salida máxima
117.964 tokens
Arquitectura
text->text
Tokenizador
GPT
Corte de conocimiento
2024-06-30
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$0.024
por millón de tokens
Salida
$0.112
por millón de tokens
API

Configuración del modelo

Razonamiento

Razonamiento obligatorio
Parámetros predeterminados
medium
Capacidades y modalidades
high, medium, low
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Esta solicitud envía un lote asíncrono con el ID del modelo base. El ID de la tarea confirma el envío, no la finalización.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"openai/gpt-oss-20b","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacidades y modalidades

EntradaSalida

Entrada
text
Salida
text
Razonamiento

No · high · medium · low

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Proveedores disponibles

1 Proveedor

Verificado: 23 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

DeepInfra

bf16
Contexto
131K
Salida máxima
118K
Entrada
$0.024
Salida
$0.112
Lectura de caché
No indicado
Escritura de caché
No indicado
openai

4 modelos

Todos los modelos
openai logoopenai

OpenAI: GPT-6 Luna Pro

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Salida
text
Entrada: $0.1Salida: $0.5por millón de tokens
Ver detalles del modelo
openai logoopenai

OpenAI: GPT-6 Luna Pro (batch)

GPT-6 Luna Pro is the same underlying model as GPT-6 Luna, served with reasoning.mode set to pro for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

Contexto
1.1M
Entrada
file · image · text
Salida
text
Entrada: $0.05Salida: $0.25por millón de tokens
Ver detalles del modelo
openai logoopenai

OpenAI: GPT-6 Luna

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Salida
text
Entrada: $0.1Salida: $0.5por millón de tokens
Ver detalles del modelo
openai logoopenai

OpenAI: GPT-6 Luna (batch)

GPT-6 Luna is the fast, cost-efficient model in OpenAI's GPT-6 series, positioned below GPT-6 Sol. It is suited for high-volume and latency-sensitive workloads such as chat, classification, and lightweight agentic...

Contexto
1.1M
Entrada
file · image · text
Salida
text
Entrada: $0.05Salida: $0.25por millón de tokens
Ver detalles del modelo