D

DeepSeek: deepseek-v3

deepseek-v3
128K contexto8.2K salidaRazonamientoHerramientasArchivosCachéEstructurado
Lanzado Dec 26, 2024Corte de conocimiento Sep 2025Actualizado Aug 27, 2026

A state-of-the-art 671B MoE model (37B active) featuring Multi-head Latent Attention (MLA) and auxiliary-loss-free load balancing. It provides a hybrid "Think/Non-think" mode, delivering SOTA performance in coding, math, and agentic tasks while remaining the most cost-efficient flagship in the 2026 market.

Modo chatTokenizador DeepSeekObsolescencia Aug 2025deepseek-ai/DeepSeek-V3.2

Precios

Precio de entrada
$0.56/ 1 M tokens51% desc.
Precio de salida
$2.24/ 1 M tokens51% desc.
Ventana de contexto 163.8K tokensEndpoints compatibles openaiProveedor DeepSeek

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedoresNo se envía por defecto
include_reasoningTodos los proveedores-
logit_biasAlgunos proveedores-
logprobsTodos los proveedores-
max_tokensTodos los proveedores-
min_pAlgunos proveedores-
presence_penaltyTodos los proveedoresNo se envía por defecto
reasoningTodos los proveedores-
repetition_penaltyAlgunos proveedoresNo se envía por defecto
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
structured_outputsTodos los proveedores-
temperatureTodos los proveedores1
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_kTodos los proveedoresNo se envía por defecto
top_logprobsTodos los proveedores-
top_pTodos los proveedores0.95

Preguntas frecuentes

Modelos similares