Especificaciones del modelo
- Context
- 1.048.576 tokens
- Salida máxima
- 262.144 tokens
- Arquitectura
- text+image+audio->text
- Tokenizador
- Other
- Corte de conocimiento
- Not provided
- Moderado
- No
Input → Output
Sí · max · high · medium · low · minimal · none
Parámetros API compatibles
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p3 proveedores
DeepInfra
fp8- Context
- 524K
- Salida máxima
- 262K
- Input
- $0.450
- Output
- $1.20
- Lectura de caché
- $0.100
- Escritura de caché
- Not provided
BaseTen
fp8- Context
- 1.0M
- Salida máxima
- 33K
- Input
- $0.500
- Output
- $1.20
- Lectura de caché
- $0.100
- Escritura de caché
- Not provided
Together
unknown- Context
- 524K
- Salida máxima
- 472K
- Input
- $0.500
- Output
- $1.20
- Lectura de caché
- $0.100
- Escritura de caché
- Not provided