Z

Zhipu: glm-5.3-flash

glm-5.3-flash
1M Kontext131.1K AusgabeReasoningToolsVideoCacheStrukturiert
Veröffentlicht Aug 26, 2026Aktualisiert Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Tokenizer OtherQuantisierung fp8Ablauf Dec 2098zai-org/GLM-5.3-Flash

Preise

Input-Preis
$0.15/ 1 Mio. Tokens
Output-Preis
$0.50/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter Zhipu

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle Anbieter-
include_reasoningAlle Anbieter-
max_tokensAlle Anbieter-
presence_penaltyAlle Anbieter-
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle Anbieter-
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle