DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance. The model includes hybrid attention for efficient long-context processing. Reasoning efforts high and xhigh are supported; xhigh maps to max reasoning. It is well suited for applications such as coding assistants, chat systems, and agent workflows where responsiveness and cost efficiency are important.
Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.
| Parámetro | Proveedores | Predeterminado |
|---|---|---|
| frequency_penalty | Algunos proveedores | No se envía por defecto |
| include_reasoning | Todos los proveedores | - |
| logit_bias | Algunos proveedores | - |
| logprobs | Algunos proveedores | - |
| max_tokens | Todos los proveedores | - |
| min_p | Algunos proveedores | - |
| presence_penalty | Algunos proveedores | No se envía por defecto |
| reasoning | Todos los proveedores | - |
| reasoning_effort | Todos los proveedores | - |
| repetition_penalty | Algunos proveedores | No se envía por defecto |
| response_format | Algunos proveedores | - |
| seed | Algunos proveedores | - |
| stop | Algunos proveedores | - |
| structured_outputs | Algunos proveedores | - |
| temperature | Todos los proveedores | No se envía por defecto |
| tool_choice | Todos los proveedores | - |
| tools | Todos los proveedores | - |
| top_k | Algunos proveedores | No se envía por defecto |
| top_logprobs | Algunos proveedores | - |
| top_p | Todos los proveedores | No se envía por defecto |
Todos los proveedores de este modelo están ocupados ahora mismo
Cada proveedor ascendente alcanzó su límite de velocidad. El modelo vuelve automáticamente cuando los límites se levantan, normalmente en cuestión de horas. Inténtalo de nuevo en un rato o cambia a otro modelo.
Solicitar este modelo en Discord