deepseek logo
deepseek

DeepSeek: DeepSeek V4 Flash 0423

Beschreibung der Quelle (Englisch)

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

Überblick

Modellspezifikationen

Kontext
1.048.576 tokens
Maximale Ausgabe
384.000 tokens
Architektur
text->text
Tokenizer
DeepSeek
Wissensstand
Nicht angegeben
Moderiert
Nein
OPENROUTER

Vollständige Preise

Mit OpenRouter synchronisierte Preise; Tokenpreise gelten pro eine Million Token.

Eingabe
$0.0886
pro 1 Mio. Token
Ausgabe
$0.1772
pro 1 Mio. Token
Cache-Lesen
$0.0177
pro 1 Mio. Token
API

Modellkonfiguration

Schlussfolgern

Reasoning erforderlich
Nein
Standardparameter
high
Fähigkeiten und Modalitäten
xhigh, high
API

Schnellstart

Setzen Sie OPENROUTER_API_KEY lokal. Python benötigt requests; JavaScript läuft in Node.js. Bewahren Sie den Schlüssel auf dem Server auf.

API-Dokumentation

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek/deepseek-v4-flash","messages":[{"role":"user","content":"Hello!"}]}'
Fähigkeiten und Modalitäten

EingabeAusgabe

Eingabe
text
Ausgabe
text
Schlussfolgern

Nein · xhigh · high

API

Unterstützte API-Parameter

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_completion_tokensmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p
Verfügbare Anbieter

15 Anbieter

Geprüft: 22. September 2026

Live-Anbieter bei OpenRouter

Verfügbarkeit, Latenz, Durchsatz und Routing ändern sich laufend. Aktuelle Betriebsdaten stehen auf der Quellseite.

OpenRouter

OpenInference

fp8
Kontext
1.0M
Maximale Ausgabe
944K
Eingabe
$0.04
Ausgabe
$0.3
Cache-Lesen
$0.014
Cache-Schreiben
Nicht angegeben

StreamLake

fp8
Kontext
1.0M
Maximale Ausgabe
384K
Eingabe
$0.0886
Ausgabe
$0.1772
Cache-Lesen
$0.0177
Cache-Schreiben
Nicht angegeben

DeepInfra

fp8
Kontext
1.0M
Maximale Ausgabe
66K
Eingabe
$0.09
Ausgabe
$0.18
Cache-Lesen
$0.018
Cache-Schreiben
Nicht angegeben

GMICloud

fp8
Kontext
1.0M
Maximale Ausgabe
944K
Eingabe
$0.091
Ausgabe
$0.182
Cache-Lesen
$0.0182
Cache-Schreiben
Nicht angegeben

Venice

Nicht angegeben
Kontext
1M
Maximale Ausgabe
33K
Eingabe
$0.0966
Ausgabe
$0.1925
Cache-Lesen
$0.0196
Cache-Schreiben
Nicht angegeben

DigitalOcean

Nicht angegeben
Kontext
1.0M
Maximale Ausgabe
384K
Eingabe
$0.098
Ausgabe
$0.196
Cache-Lesen
$0.0196
Cache-Schreiben
Nicht angegeben

SiliconFlow

fp8
Kontext
1.0M
Maximale Ausgabe
393K
Eingabe
$0.13
Ausgabe
$0.28
Cache-Lesen
$0.028
Cache-Schreiben
Nicht angegeben

Alibaba

fp8
Kontext
1M
Maximale Ausgabe
393K
Eingabe
$0.134
Ausgabe
$0.268
Cache-Lesen
$0.0268
Cache-Schreiben
Nicht angegeben

Baidu

fp8
Kontext
1.0M
Maximale Ausgabe
131K
Eingabe
$0.14
Ausgabe
$0.28
Cache-Lesen
$0.028
Cache-Schreiben
Nicht angegeben

Novita

fp8
Kontext
1.0M
Maximale Ausgabe
393K
Eingabe
$0.14
Ausgabe
$0.28
Cache-Lesen
$0.028
Cache-Schreiben
Nicht angegeben

AtlasCloud

fp4
Kontext
1.0M
Maximale Ausgabe
393K
Eingabe
$0.14
Ausgabe
$0.28
Cache-Lesen
$0.028
Cache-Schreiben
Nicht angegeben

Parasail

fp8
Kontext
1.0M
Maximale Ausgabe
944K
Eingabe
$0.14
Ausgabe
$0.28
Cache-Lesen
$0.07
Cache-Schreiben
Nicht angegeben

NextBit

fp8
Kontext
1.0M
Maximale Ausgabe
944K
Eingabe
$0.15
Ausgabe
$0.3
Cache-Lesen
$0.035
Cache-Schreiben
Nicht angegeben

Mancer 2

fp8
Kontext
1.0M
Maximale Ausgabe
944K
Eingabe
$0.19
Ausgabe
$0.5
Cache-Lesen
Nicht angegeben
Cache-Schreiben
Nicht angegeben

Azure

Nicht angegeben
Kontext
1.0M
Maximale Ausgabe
384K
Eingabe
$0.21
Ausgabe
$0.56
Cache-Lesen
$0.031
Cache-Schreiben
Nicht angegeben
deepseek

4 Modelle

Alle Modelle