Z

Zhipu: glm-5.3-flash-think-search:free

glm-5.3-flash-think-search:free
1M Kontext943.7K AusgabeReasoningToolsParallele ToolsVisionVideoCacheStrukturiert
Veröffentlicht Aug 26, 2026Aktualisiert Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Modus chatTokenizer OtherQuantisierung fp8zai-org/GLM-5.3-Flash

Alle Anbieter für dieses Modell sind gerade ausgelastet

Jeder Upstream-Anbieter hat sein Ratenlimit erreicht. Das Modell kommt automatisch zurück, sobald die Limits fallen, meist innerhalb von Stunden. Versuche es später erneut oder wechsle zu einem anderen Modell.

Dieses Modell auf Discord anfragen

Preise

Input-Preis
$0.00/ 1 Mio. Tokens
Output-Preis
$0.00/ 1 Mio. Tokens
Kompatible Endpunkte openaiAnbieter Zhipu

Verfügbarkeit

Leistung

Lade Leistungsdaten...

Nutzung & Rang

Nutzung wird geladen...

Unterstützte Parameter

Alle Anbieter = jeder Upstream, der dieses Modell bereitstellt, unterstützt den Parameter. Einige Anbieter = hängt vom Upstream ab, der die Anfrage bearbeitet. Standard = der Wert, der gesendet wird, wenn nichts gesetzt ist.

ParameterAnbieterStandard
frequency_penaltyAlle Anbieter-
include_reasoningAlle Anbieter-
logit_biasEinige Anbieter-
logprobsEinige Anbieter-
max_tokensAlle Anbieter-
min_pEinige Anbieter-
parallel_tool_callsEinige Anbieter-
presence_penaltyAlle Anbieter-
reasoningAlle Anbieter-
reasoning_effortAlle Anbieter-
repetition_penaltyAlle Anbieter-
response_formatAlle Anbieter-
seedAlle Anbieter-
stopAlle Anbieter-
structured_outputsAlle Anbieter-
temperatureAlle Anbieter1
tool_choiceAlle Anbieter-
toolsAlle Anbieter-
top_kAlle Anbieter-
top_logprobsEinige Anbieter-
top_pAlle Anbieter0.95

Häufige Fragen

Ähnliche Modelle