D

DeepSeek: deepseek-v4-flash-0731:free

deepseek-v4-flash-0731:free
1M הקשר384K פלטחשיבהכליםכלים מקביליםראייהמטמוןמובנה
שוחרר Jul 31, 2026עודכן Oct 8, 2026

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.

מצב chatמטקנן DeepSeekקוונטיזציה fp8הוצאה משימוש Dec 2026deepseek-ai/DeepSeek-V4-Flash-0731

כל הספקים של מודל זה עסוקים כרגע

כל ספק במעלה הזרם הגיע למגבלת הקצב שלו. המודל חוזר אוטומטית ברגע שהמגבלות מוסרות, בדרך כלל תוך שעות. נסה שוב בעוד זמן קצר או עבור למודל אחר.

בקש את המודל הזה בדיסקורד

תמחור

מחיר קלט
$0.00/ מיליון אסימונים
מחיר פלט
$0.00/ מיליון אסימונים
נקודות קצה תואמות openaiספק DeepSeek

זמן פעילות

ביצועים

טוען נתוני ביצועים...

שימוש ודירוג

טוען שימוש...

פרמטרים נתמכים

כל הספקים = נתמך אצל כל upstream שמגיש את המודל הזה. חלק מהספקים = תלוי ב-upstream שמטפל בבקשה. ברירת מחדל = הערך שנשלח כשלא הגדרת דבר.

פרמטרספקיםברירת מחדל
frequency_penaltyכל הספקים-
include_reasoningכל הספקים-
logit_biasחלק מהספקים-
logprobsכל הספקים-
max_tokensכל הספקים-
min_pחלק מהספקים-
parallel_tool_callsחלק מהספקים-
presence_penaltyכל הספקים-
reasoningכל הספקים-
reasoning_effortכל הספקים-
repetition_penaltyכל הספקים-
response_formatכל הספקים-
seedכל הספקים-
stopכל הספקים-
structured_outputsכל הספקים-
temperatureכל הספקים-
tool_choiceכל הספקים-
toolsכל הספקים-
top_aחלק מהספקים-
top_kכל הספקים-
top_logprobsכל הספקים-
top_pכל הספקים-

שאלות נפוצות

מודלים דומים