Z
Zhipu: glm-5.3-flash
glm-5.3-flash
1M contexto131.1K saídaRaciocínioFerramentasVídeoCacheEstruturado
Lançado Aug 26, 2026Atualizado Aug 26, 2026
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.
Preços
Preço de entrada
$0.15/ 1 M tokens
Preço de saída
$0.50/ 1 M tokens
Endpoints compatíveis openaiFornecedor Zhipu
Tempo de atividade
Desempenho
Carregando dados de desempenho...
Uso e classificação
Carregando uso...
Parâmetros suportados
Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.
| Parâmetro | Provedores | Padrão |
|---|---|---|
| frequency_penalty | Todos os provedores | - |
| include_reasoning | Todos os provedores | - |
| max_tokens | Todos os provedores | - |
| presence_penalty | Todos os provedores | - |
| reasoning | Todos os provedores | - |
| reasoning_effort | Todos os provedores | - |
| repetition_penalty | Todos os provedores | - |
| response_format | Todos os provedores | - |
| seed | Todos os provedores | - |
| stop | Todos os provedores | - |
| temperature | Todos os provedores | 1 |
| tool_choice | Todos os provedores | - |
| tools | Todos os provedores | - |
| top_k | Todos os provedores | - |
| top_p | Todos os provedores | 0.95 |