Z

Zhipu: glm-5.3-flash-thinking:free

glm-5.3-flash-thinking:free
1M Kontext131.1K AusgabeReasoningToolsParallele ToolsVideoCacheStrukturiert
Veröffentlicht Aug 26, 2026Aktualisiert Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Tokenizer OtherAblauf Dec 2098zai-org/GLM-5.3-Flash

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter Zhipu

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle Anbieter-
include_reasoningAlle Anbieter-
logit_biasEinige Anbieter-
logprobsEinige Anbieter-
max_tokensAlle Anbieter-
min_pEinige Anbieter-
presence_penaltyAlle Anbieter-
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
structured_outputsEinige Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle Anbieter-
top_logprobsEinige Anbieter-
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle