Especificações do modelo
- Context
- 1.000.000 tokens
- Saída máxima
- 65.536 tokens
- Arquitetura
- text->text
- Tokenizador
- Other
- Limite de conhecimento
- Not provided
- Moderado
- Não
Input → Output
Não
Parâmetros de API compatíveis
include_reasoningmax_tokensreasoningseedtemperaturetool_choicetoolstop_p2 provedores
DeepInfra
bf16- Context
- 262K
- Saída máxima
- 131K
- Input
- $0.080
- Output
- $0.200
- Leitura de cache
- $0.040
- Gravação de cache
- Not provided
CoreWeave
bf16- Context
- 262K
- Saída máxima
- 236K
- Input
- $0.100
- Output
- $0.250
- Leitura de cache
- $0.050
- Gravação de cache
- Not provided