DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
כל הספקים = נתמך אצל כל upstream שמגיש את המודל הזה. חלק מהספקים = תלוי ב-upstream שמטפל בבקשה. ברירת מחדל = הערך שנשלח כשלא הגדרת דבר.
| פרמטר | ספקים | ברירת מחדל |
|---|---|---|
| frequency_penalty | חלק מהספקים | לא נשלח כברירת מחדל |
| include_reasoning | כל הספקים | - |
| logit_bias | חלק מהספקים | - |
| logprobs | חלק מהספקים | - |
| max_tokens | כל הספקים | - |
| min_p | חלק מהספקים | - |
| presence_penalty | חלק מהספקים | לא נשלח כברירת מחדל |
| reasoning | כל הספקים | - |
| reasoning_effort | כל הספקים | - |
| repetition_penalty | חלק מהספקים | לא נשלח כברירת מחדל |
| response_format | חלק מהספקים | - |
| seed | חלק מהספקים | - |
| stop | חלק מהספקים | - |
| structured_outputs | חלק מהספקים | - |
| temperature | כל הספקים | לא נשלח כברירת מחדל |
| tool_choice | כל הספקים | - |
| tools | כל הספקים | - |
| top_k | חלק מהספקים | לא נשלח כברירת מחדל |
| top_logprobs | חלק מהספקים | - |
| top_p | כל הספקים | לא נשלח כברירת מחדל |
כל הספקים של מודל זה עסוקים כרגע
כל ספק במעלה הזרם הגיע למגבלת הקצב שלו. המודל חוזר אוטומטית ברגע שהמגבלות מוסרות, בדרך כלל תוך שעות. נסה שוב בעוד זמן קצר או עבור למודל אחר.
בקש את המודל הזה בדיסקורד