DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.
| Parameter | Anbieter | Standard |
|---|---|---|
| frequency_penalty | Einige Anbieter | Standardmäßig nicht gesendet |
| include_reasoning | Alle Anbieter | - |
| logit_bias | Einige Anbieter | - |
| logprobs | Einige Anbieter | - |
| max_tokens | Alle Anbieter | - |
| min_p | Einige Anbieter | - |
| presence_penalty | Einige Anbieter | Standardmäßig nicht gesendet |
| reasoning | Alle Anbieter | - |
| reasoning_effort | Alle Anbieter | - |
| repetition_penalty | Einige Anbieter | Standardmäßig nicht gesendet |
| response_format | Einige Anbieter | - |
| seed | Einige Anbieter | - |
| stop | Einige Anbieter | - |
| structured_outputs | Einige Anbieter | - |
| temperature | Alle Anbieter | Standardmäßig nicht gesendet |
| tool_choice | Alle Anbieter | - |
| tools | Alle Anbieter | - |
| top_k | Einige Anbieter | Standardmäßig nicht gesendet |
| top_logprobs | Einige Anbieter | - |
| top_p | Alle Anbieter | Standardmäßig nicht gesendet |
Alle Anbieter für dieses Modell sind gerade ausgelastet
Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.
Dieses Modell auf Discord anfragen