DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.
| Paramètre | Fournisseurs | Par défaut |
|---|---|---|
| frequency_penalty | Certains fournisseurs | Non envoyé par défaut |
| include_reasoning | Tous les fournisseurs | - |
| logit_bias | Certains fournisseurs | - |
| logprobs | Certains fournisseurs | - |
| max_tokens | Tous les fournisseurs | - |
| min_p | Certains fournisseurs | - |
| presence_penalty | Certains fournisseurs | Non envoyé par défaut |
| reasoning | Tous les fournisseurs | - |
| reasoning_effort | Tous les fournisseurs | - |
| repetition_penalty | Certains fournisseurs | Non envoyé par défaut |
| response_format | Certains fournisseurs | - |
| seed | Certains fournisseurs | - |
| stop | Certains fournisseurs | - |
| structured_outputs | Certains fournisseurs | - |
| temperature | Tous les fournisseurs | Non envoyé par défaut |
| tool_choice | Tous les fournisseurs | - |
| tools | Tous les fournisseurs | - |
| top_k | Certains fournisseurs | Non envoyé par défaut |
| top_logprobs | Certains fournisseurs | - |
| top_p | Tous les fournisseurs | Non envoyé par défaut |
Tous les fournisseurs de ce modèle sont occupés en ce moment
Chaque fournisseur amont a atteint sa limite de débit. Le modèle revient automatiquement dès que les limites se lèvent, généralement en quelques heures. Réessayez dans un moment ou passez à un autre modèle.
Demander ce modèle sur Discord