Especificaciones del modelo
- Contexto
- 131.072 tokens
- Salida máxima
- 117.964 tokens
- Arquitectura
- text->text
- Tokenizador
- GPT
- Corte de conocimiento
- 2024-06-30
- Moderado
- No
Precios completos
Tarifas sincronizadas desde OpenRouter, por millón de tokens.
- Entrada
- $0.024 por millón de tokens
- Salida
- $0.112 por millón de tokens
Configuración del modelo
Razonamiento
- Razonamiento obligatorio
- Sí
- Parámetros predeterminados
- medium
- Capacidades y modalidades
- high, medium, low
Inicio rápido
Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.
Esta solicitud envía un lote asíncrono con el ID del modelo base. El ID de la tarea confirma el envío, no la finalización.
curl --fail-with-body https://openrouter.ai/api/beta/batches \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"endpoint":"/v1/chat/completions","model":"openai/gpt-oss-20b","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'
# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"Entrada → Salida
No · high · medium · low
Parámetros API compatibles
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p1 Proveedor
Verificado: 23 de septiembre de 2026
Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.
DeepInfra
bf16- Contexto
- 131K
- Salida máxima
- 118K
- Entrada
- $0.024
- Salida
- $0.112
- Lectura de caché
- No indicado
- Escritura de caché
- No indicado