D

DeepSeek: deepseek-v4.1-flash:free

deepseek-v4.1-flash:free
1.0M контекст384K выводРассуждениеИнструментыЗрениеКэшСтруктурир.
Выпущено Sep 10, 2026Обновлено Sep 15, 2026

DeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the first built on the company's Causal Encoder-Decoder (CED) architecture. It activates 8B parameters on input and 16B on output from a 552B-parameter backbone, an asymmetric split that keeps per-token compute low relative to the model's total size. Image understanding is native to the architecture, with visual and text embeddings trained jointly from the start of pre-training rather than added afterward as in the earlier experimental V4 Flash Vision Exp. It is suited for coding, terminal, and computer-use agents, along with long-horizon tasks that must run to completion across many steps and long-context analysis. Compressed KV caching cuts cache memory to roughly a quarter of the previous Flash generation, significantly reducing costs on agentic workloads. DeepSeek positions it as the cost-efficient tier of the V4.1 family and reports that it exceeds V4 Pro on performance, speed, and task completion time.

Режим chatТокенизатор DeepSeekКвантизация fp8deepseek-ai/DeepSeek-V4.1-Flash

Все провайдеры этой модели сейчас заняты

Каждый вышестоящий провайдер достиг своего лимита запросов. Модель вернётся автоматически, как только лимиты снимутся, обычно в течение нескольких часов. Попробуйте позже или переключитесь на другую модель.

Запросить эту модель в Discord

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Совместимые эндпоинты -Вендор DeepSeek

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyВсе провайдеры-
include_reasoningВсе провайдеры-
logit_biasНекоторые провайдеры-
logprobsНекоторые провайдеры-
max_tokensВсе провайдеры-
min_pНекоторые провайдеры-
presence_penaltyВсе провайдеры-
reasoningВсе провайдеры-
reasoning_effortВсе провайдеры-
repetition_penaltyВсе провайдеры-
response_formatВсе провайдеры-
seedНекоторые провайдеры-
stopВсе провайдеры-
structured_outputsВсе провайдеры-
temperatureВсе провайдеры-
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kВсе провайдеры-
top_logprobsНекоторые провайдеры-
top_pВсе провайдеры-

Часто задаваемые вопросы

Похожие модели