Caractéristiques du modèle
- Context
- 8 192 tokens
- Sortie maximale
- 4 096 tokens
- Architecture
- text->text
- Tokenizer
- Other
- Limite des connaissances
- Not provided
- Modéré
- Non
Input → Output
Paramètres API pris en charge
max_completion_tokensmax_tokensstoptemperature1 Fournisseur
Tencent
fp8- Context
- 8K
- Sortie maximale
- 4K
- Input
- $0.044
- Output
- $0.177
- Lecture du cache
- Not provided
- Écriture du cache
- Not provided