Z
Zhipu: glm-5.3-flash
glm-5.3-flash
1M Kontext131.1K AusgabeReasoningToolsVideoCacheStrukturiert
Veröffentlicht Aug 26, 2026Aktualisiert Aug 26, 2026
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.
Preise
Input-Preis
$0.15/ 1 Mio. Tokens
Output-Preis
$0.50/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter Zhipu
Verfügbarkeit
Leistung
Lade Leistungsdaten...
Nutzung & Rang
Nutzung wird geladen...
Unterstützte Parameter
Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.
| Parameter | Anbieter | Standard |
|---|---|---|
| frequency_penalty | Alle Anbieter | - |
| include_reasoning | Alle Anbieter | - |
| max_tokens | Alle Anbieter | - |
| presence_penalty | Alle Anbieter | - |
| reasoning | Alle Anbieter | - |
| reasoning_effort | Alle Anbieter | - |
| repetition_penalty | Alle Anbieter | - |
| response_format | Alle Anbieter | - |
| seed | Alle Anbieter | - |
| stop | Alle Anbieter | - |
| temperature | Alle Anbieter | 1 |
| tool_choice | Alle Anbieter | - |
| tools | Alle Anbieter | - |
| top_k | Alle Anbieter | - |
| top_p | Alle Anbieter | 0.95 |