Model specifications
- Context
- 40,960 tokens
- Maximum output
- 36,864 tokens
- Architecture
- text->rerank
- Tokenizer
- Qwen3
- Knowledge cutoff
- Not provided
- Moderated
- No
Input → Output
Supported API parameters
frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatstopstructured_outputstemperaturetop_ktop_logprobstop_p1 Provider
Fireworks
unknown- Context
- 41K
- Maximum output
- 37K
- Input
- Free
- Output
- Free
- Cache read
- Not provided
- Cache write
- Not provided