Especificações do modelo
- Context
- 40.960 tokens
- Saída máxima
- 36.864 tokens
- Arquitetura
- text->rerank
- Tokenizador
- Qwen3
- Limite de conhecimento
- Not provided
- Moderado
- Não
Input → Output
Parâmetros de API compatíveis
frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatstopstructured_outputstemperaturetop_ktop_logprobstop_p1 Provedor
Fireworks
unknown- Context
- 41K
- Saída máxima
- 37K
- Input
- Free
- Output
- Free
- Leitura de cache
- Not provided
- Gravação de cache
- Not provided