DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.
| Parameter | Penyedia | Default |
|---|---|---|
| frequency_penalty | Sebagian penyedia | Tidak dikirim secara bawaan |
| include_reasoning | Semua penyedia | - |
| logit_bias | Sebagian penyedia | - |
| logprobs | Sebagian penyedia | - |
| max_tokens | Semua penyedia | - |
| min_p | Sebagian penyedia | - |
| presence_penalty | Sebagian penyedia | Tidak dikirim secara bawaan |
| reasoning | Semua penyedia | - |
| reasoning_effort | Semua penyedia | - |
| repetition_penalty | Sebagian penyedia | Tidak dikirim secara bawaan |
| response_format | Sebagian penyedia | - |
| seed | Sebagian penyedia | - |
| stop | Sebagian penyedia | - |
| structured_outputs | Sebagian penyedia | - |
| temperature | Semua penyedia | Tidak dikirim secara bawaan |
| tool_choice | Semua penyedia | - |
| tools | Semua penyedia | - |
| top_k | Sebagian penyedia | Tidak dikirim secara bawaan |
| top_logprobs | Sebagian penyedia | - |
| top_p | Semua penyedia | Tidak dikirim secara bawaan |
Semua penyedia model ini sedang sibuk saat ini
Setiap penyedia upstream telah mencapai batas lajunya. Model kembali otomatis begitu batasnya longgar, biasanya dalam hitungan jam. Coba lagi sebentar lagi atau beralih ke model lain.
Minta model ini di Discord