Z

Zhipu: glm-5.3-flash

glm-5.3-flash
1M контекст131.1K выводРассуждениеИнструментыВидеоКэшСтруктурир.
Выпущено Aug 26, 2026Обновлено Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Токенизатор OtherКвантизация fp8Истечение Dec 2098zai-org/GLM-5.3-Flash

Тарифы

Цена за вход
$0.15/ 1 млн токенов
Цена за выход
$0.50/ 1 млн токенов
Совместимые эндпоинты openaiВендор Zhipu

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyВсе провайдеры-
include_reasoningВсе провайдеры-
max_tokensВсе провайдеры-
presence_penaltyВсе провайдеры-
reasoningВсе провайдеры-
reasoning_effortВсе провайдеры-
repetition_penaltyВсе провайдеры-
response_formatВсе провайдеры-
seedВсе провайдеры-
stopВсе провайдеры-
temperatureВсе провайдеры1
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kВсе провайдеры-
top_pВсе провайдеры0.95

Часто задаваемые вопросы

Похожие модели