Z

Zhipu: glm-5.3-flash-thinking:free

glm-5.3-flash-thinking:free
1M contexto131.1K salidaRazonamientoHerramientasHerramientas paralelasVideoCachéEstructurado
Lanzado Aug 26, 2026Actualizado Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Tokenizador OtherExpiración Dec 2098zai-org/GLM-5.3-Flash

Precios

Precio de entrada
$0.00/ 1 M tokens
Precio de salida
$0.00/ 1 M tokens
Endpoints compatibles openaiProveedor Zhipu

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedores-
include_reasoningTodos los proveedores-
logit_biasAlgunos proveedores-
logprobsAlgunos proveedores-
max_tokensTodos los proveedores-
min_pAlgunos proveedores-
presence_penaltyTodos los proveedores-
reasoningTodos los proveedores-
reasoning_effortTodos los proveedores-
repetition_penaltyTodos los proveedores-
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
structured_outputsAlgunos proveedores-
temperatureTodos los proveedores1
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_kTodos los proveedores-
top_logprobsAlgunos proveedores-
top_pTodos los proveedores0.95

Preguntas frecuentes

Modelos similares