Specyfikacja modelu
- Context
- 40 960 tokens
- Maksymalne wyjście
- 36 864 tokens
- Architektura
- text->rerank
- Tokenizer
- Qwen3
- Granica wiedzy
- Not provided
- Moderowany
- Nie
Input → Output
Obsługiwane parametry API
frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatstopstructured_outputstemperaturetop_ktop_logprobstop_p1 Dostawca
Fireworks
unknown- Context
- 41K
- Maksymalne wyjście
- 37K
- Input
- Free
- Output
- Free
- Odczyt pamięci podręcznej
- Not provided
- Zapis pamięci podręcznej
- Not provided