Z

Zhipu: glm-5.3-flash-thinking:free

glm-5.3-flash-thinking:free
1M contesto131.1K outputRagionamentoStrumentiStrumenti paralleliVideoCacheStrutturato
Rilasciato Aug 26, 2026Aggiornato Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Tokenizer OtherScadenza Dec 2098zai-org/GLM-5.3-Flash

Prezzi

Prezzo di input
$0.00/ 1 M token
Prezzo di output
$0.00/ 1 M token
Endpoint compatibili openaiProvider Zhipu

Disponibilità

Performance

Caricamento dati di performance...

Utilizzo e classifica

Caricamento utilizzo...

Parametri supportati

Tutti i provider = supportato da ogni upstream che serve questo modello. Alcuni provider = dipende dall'upstream che gestisce la richiesta. Predefinito = il valore inviato quando non lo imposti.

ParametroProviderPredefinito
frequency_penaltyTutti i provider-
include_reasoningTutti i provider-
logit_biasAlcuni provider-
logprobsAlcuni provider-
max_tokensTutti i provider-
min_pAlcuni provider-
presence_penaltyTutti i provider-
reasoningTutti i provider-
reasoning_effortTutti i provider-
repetition_penaltyTutti i provider-
response_formatTutti i provider-
seedTutti i provider-
stopTutti i provider-
structured_outputsAlcuni provider-
temperatureTutti i provider1
tool_choiceTutti i provider-
toolsTutti i provider-
top_kTutti i provider-
top_logprobsAlcuni provider-
top_pTutti i provider0.95

Domande frequenti

Modelli simili