Modellspezifikationen
- Context
- 262.144 tokens
- Maximale Ausgabe
- 131.072 tokens
- Architektur
- text->text
- Tokenizer
- Other
- Wissensstand
- Nicht angegeben
- Moderiert
- Nein
Eingabe → Ausgabe
Nein
Unterstützte API-Parameter
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p2 Anbieter
DeepInfra
bf16- Context
- 262K
- Maximale Ausgabe
- 131K
- Eingabe
- $0.080
- Ausgabe
- $0.200
- Cache-Lesen
- $0.040
- Cache-Schreiben
- Nicht angegeben
CoreWeave
bf16- Context
- 262K
- Maximale Ausgabe
- 236K
- Eingabe
- $0.100
- Ausgabe
- $0.250
- Cache-Lesen
- $0.050
- Cache-Schreiben
- Nicht angegeben