Modellspezifikationen
- Context
- 1.048.576 tokens
- Maximale Ausgabe
- 262.144 tokens
- Architektur
- text->text
- Tokenizer
- Qwen
- Wissensstand
- Nicht angegeben
- Moderiert
- Nein
Eingabe → Ausgabe
Ja · xhigh · medium · low
Unterstützte API-Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p7 Anbieter
DeepInfra
fp4- Context
- 262K
- Maximale Ausgabe
- 131K
- Eingabe
- $2.00
- Ausgabe
- $6.00
- Cache-Lesen
- $0.200
- Cache-Schreiben
- Nicht angegeben
Modal
unknown- Context
- 1M
- Maximale Ausgabe
- 262K
- Eingabe
- $2.00
- Ausgabe
- $6.00
- Cache-Lesen
- $0.250
- Cache-Schreiben
- Nicht angegeben
Novita
unknown- Context
- 1M
- Maximale Ausgabe
- 131K
- Eingabe
- $2.00
- Ausgabe
- $6.00
- Cache-Lesen
- $0.250
- Cache-Schreiben
- Nicht angegeben
SiliconFlow
fp8- Context
- 1.0M
- Maximale Ausgabe
- 131K
- Eingabe
- $2.00
- Ausgabe
- $6.00
- Cache-Lesen
- $0.250
- Cache-Schreiben
- Nicht angegeben
Alibaba
unknown- Context
- 1M
- Maximale Ausgabe
- 131K
- Eingabe
- $2.00
- Ausgabe
- $6.00
- Cache-Lesen
- $0.250
- Cache-Schreiben
- $2.50
Together
unknown- Context
- 1.0M
- Maximale Ausgabe
- 909K
- Eingabe
- $2.50
- Ausgabe
- $6.25
- Cache-Lesen
- $0.500
- Cache-Schreiben
- Nicht angegeben
Venice
unknown- Context
- 262K
- Maximale Ausgabe
- 66K
- Eingabe
- $2.50
- Ausgabe
- $7.50
- Cache-Lesen
- $0.313
- Cache-Schreiben
- Nicht angegeben