Z

Zhipu: glm-5.3-flash-think-search:free

glm-5.3-flash-think-search:free
1M контекст943.7K выводРассуждениеИнструментыПараллельные инструментыЗрениеВидеоКэшСтруктурир.
Выпущено Aug 26, 2026Обновлено Aug 26, 2026

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

Режим chatТокенизатор OtherКвантизация fp8zai-org/GLM-5.3-Flash

Все провайдеры этой модели сейчас заняты

Каждый вышестоящий провайдер достиг своего лимита запросов. Модель вернётся автоматически, как только лимиты снимутся, обычно в течение нескольких часов. Попробуйте позже или переключитесь на другую модель.

Запросить эту модель в Discord

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Совместимые эндпоинты openaiВендор Zhipu

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyВсе провайдеры-
include_reasoningВсе провайдеры-
logit_biasНекоторые провайдеры-
logprobsНекоторые провайдеры-
max_tokensВсе провайдеры-
min_pНекоторые провайдеры-
parallel_tool_callsНекоторые провайдеры-
presence_penaltyВсе провайдеры-
reasoningВсе провайдеры-
reasoning_effortВсе провайдеры-
repetition_penaltyВсе провайдеры-
response_formatВсе провайдеры-
seedВсе провайдеры-
stopВсе провайдеры-
structured_outputsВсе провайдеры-
temperatureВсе провайдеры1
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kВсе провайдеры-
top_logprobsНекоторые провайдеры-
top_pВсе провайдеры0.95

Часто задаваемые вопросы

Похожие модели