DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Tüm sağlayıcılar = bu modeli sunan her upstream destekler. Bazı sağlayıcılar = isteği işleyen upstream'e bağlıdır. Varsayılan = ayarlamadığınızda gönderilen değer.
| Parametre | Sağlayıcılar | Varsayılan |
|---|---|---|
| frequency_penalty | Bazı sağlayıcılar | Varsayılan olarak gönderilmez |
| include_reasoning | Tüm sağlayıcılar | - |
| logit_bias | Bazı sağlayıcılar | - |
| logprobs | Bazı sağlayıcılar | - |
| max_tokens | Tüm sağlayıcılar | - |
| min_p | Bazı sağlayıcılar | - |
| presence_penalty | Bazı sağlayıcılar | Varsayılan olarak gönderilmez |
| reasoning | Tüm sağlayıcılar | - |
| reasoning_effort | Tüm sağlayıcılar | - |
| repetition_penalty | Bazı sağlayıcılar | Varsayılan olarak gönderilmez |
| response_format | Bazı sağlayıcılar | - |
| seed | Bazı sağlayıcılar | - |
| stop | Bazı sağlayıcılar | - |
| structured_outputs | Bazı sağlayıcılar | - |
| temperature | Tüm sağlayıcılar | Varsayılan olarak gönderilmez |
| tool_choice | Tüm sağlayıcılar | - |
| tools | Tüm sağlayıcılar | - |
| top_k | Bazı sağlayıcılar | Varsayılan olarak gönderilmez |
| top_logprobs | Bazı sağlayıcılar | - |
| top_p | Tüm sağlayıcılar | Varsayılan olarak gönderilmez |
Bu modelin tüm sağlayıcıları şu anda meşgul
Her üst akış sağlayıcısı hız sınırına ulaştı. Sınırlar kalkınca model otomatik olarak geri gelir, genellikle birkaç saat içinde. Biraz sonra tekrar deneyin ya da başka bir modele geçin.
Bu modeli Discord'da iste