Specifiche del modello
- Contesto
- 1.048.576 tokens
- Output massimo
- 393.216 tokens
- Architettura
- text->text
- Tokenizer
- DeepSeek
- Limite di conoscenza
- Non indicato
- Moderato
- No
Prezzi completi
Tariffe sincronizzate da OpenRouter, per milione di token.
- Input
- $0.87 /M tokens
- Output
- $1.74 /M tokens
- Lettura cache
- $0.174 /M tokens
Configurazione del modello
Parametri predefiniti
temperature- 1
top_p- 1
Ragionamento
- Moderato
- No
- Parametri predefiniti
- high
- Capacità e modalità
- xhigh, high
Avvio rapido
Chiama questo modello tramite l’API compatibile OpenAI di OpenRouter.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek/deepseek-v4-pro","messages":[{"role":"user","content":"Hello!"}]}'Input → Output
No · xhigh · high
Parametri API supportati
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_completion_tokensmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p17 provider
Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.
DigitalOcean
unknown- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $0.870
- Output
- $1.74
- Lettura cache
- $0.174
- Scrittura cache
- Non indicato
StreamLake
fp8- Contesto
- 1.0M
- Output massimo
- 384K
- Input
- $1.04
- Output
- $2.08
- Lettura cache
- $0.087
- Scrittura cache
- Non indicato
GMICloud
fp8- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $1.04
- Output
- $2.09
- Lettura cache
- $0.087
- Scrittura cache
- Non indicato
Ionstream
fp4- Contesto
- 1.0M
- Output massimo
- 393K
- Input
- $1.13
- Output
- $2.26
- Lettura cache
- $0.094
- Scrittura cache
- Non indicato
CoreWeave
fp8- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $1.15
- Output
- $2.55
- Lettura cache
- $0.200
- Scrittura cache
- Non indicato
DeepInfra
fp8- Contesto
- 1.0M
- Output massimo
- 16K
- Input
- $1.30
- Output
- $2.60
- Lettura cache
- $0.100
- Scrittura cache
- Non indicato
Alibaba
fp8- Contesto
- 1M
- Output massimo
- 393K
- Input
- $1.42
- Output
- $2.83
- Lettura cache
- $0.118
- Scrittura cache
- Non indicato
SiliconFlow
fp8- Contesto
- 1.0M
- Output massimo
- 393K
- Input
- $1.50
- Output
- $3.14
- Lettura cache
- $0.135
- Scrittura cache
- Non indicato
Novita
fp8- Contesto
- 1.0M
- Output massimo
- 393K
- Input
- $1.60
- Output
- $3.20
- Lettura cache
- $0.135
- Scrittura cache
- Non indicato
Venice
unknown- Contesto
- 1M
- Output massimo
- 33K
- Input
- $1.65
- Output
- $3.30
- Lettura cache
- $0.330
- Scrittura cache
- Non indicato
AtlasCloud
fp4- Contesto
- 1.0M
- Output massimo
- 393K
- Input
- $1.68
- Output
- $3.38
- Lettura cache
- $0.130
- Scrittura cache
- Non indicato
Baidu
fp8- Contesto
- 1.0M
- Output massimo
- 393K
- Input
- $1.69
- Output
- $3.38
- Lettura cache
- $0.140
- Scrittura cache
- Non indicato
NextBit
fp8- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $1.72
- Output
- $3.45
- Lettura cache
- $0.140
- Scrittura cache
- Non indicato
BaseTen
fp4- Contesto
- 1.0M
- Output massimo
- 262K
- Input
- $1.74
- Output
- $3.48
- Lettura cache
- $0.145
- Scrittura cache
- Non indicato
Fireworks
unknown- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $1.74
- Output
- $3.48
- Lettura cache
- $0.145
- Scrittura cache
- Non indicato
Parasail
fp8- Contesto
- 1.0M
- Output massimo
- 944K
- Input
- $1.74
- Output
- $3.48
- Lettura cache
- $0.100
- Scrittura cache
- Non indicato
Azure
unknown- Contesto
- 1.0M
- Output massimo
- 384K
- Input
- $1.91
- Output
- $3.83
- Lettura cache
- $0.160
- Scrittura cache
- Non indicato