DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Tất cả nhà cung cấp = mọi upstream phục vụ mô hình này đều hỗ trợ. Một số nhà cung cấp = tùy thuộc upstream xử lý yêu cầu. Mặc định = giá trị được gửi khi bạn không thiết lập.
| Tham số | Nhà cung cấp | Mặc định |
|---|---|---|
| frequency_penalty | Một số nhà cung cấp | Mặc định không gửi |
| include_reasoning | Tất cả nhà cung cấp | - |
| logit_bias | Một số nhà cung cấp | - |
| logprobs | Một số nhà cung cấp | - |
| max_tokens | Tất cả nhà cung cấp | - |
| min_p | Một số nhà cung cấp | - |
| presence_penalty | Một số nhà cung cấp | Mặc định không gửi |
| reasoning | Tất cả nhà cung cấp | - |
| reasoning_effort | Tất cả nhà cung cấp | - |
| repetition_penalty | Một số nhà cung cấp | Mặc định không gửi |
| response_format | Một số nhà cung cấp | - |
| seed | Một số nhà cung cấp | - |
| stop | Một số nhà cung cấp | - |
| structured_outputs | Một số nhà cung cấp | - |
| temperature | Tất cả nhà cung cấp | Mặc định không gửi |
| tool_choice | Tất cả nhà cung cấp | - |
| tools | Tất cả nhà cung cấp | - |
| top_k | Một số nhà cung cấp | Mặc định không gửi |
| top_logprobs | Một số nhà cung cấp | - |
| top_p | Tất cả nhà cung cấp | Mặc định không gửi |
Tất cả nhà cung cấp của mô hình này hiện đang bận
Mọi nhà cung cấp thượng nguồn đã chạm giới hạn tốc độ. Mô hình tự động trở lại khi giới hạn được gỡ, thường trong vài giờ. Hãy thử lại sau ít phút hoặc chuyển sang mô hình khác.
Yêu cầu mô hình này trên Discord