Z

Zhipu: glm-4.5-flash:free

glm-4.5-flash:free
131.1K contexto32K saídaRaciocínioFerramentasFerramentas paralelasCacheEstruturado
Lançado Jul 25, 2025Corte de conhecimento Dec 2024Atualizado Sep 14, 2026

GLM-4.5 is our latest flagship foundation model, purpose-built for agent-based applications. It leverages a Mixture-of-Experts (MoE) architecture and supports a context length of up to 128k tokens. GLM-4.5 delivers significantly enhanced capabilities in reasoning, code generation, and agent alignment. It supports a hybrid inference mode with two options, a "thinking mode" designed for complex reasoning and tool use, and a "non-thinking mode" optimized for instant responses. Users can control the reasoning behaviour with the reasoning enabled boolean. Learn more in our docs

Modo chatTokenizador OtherQuantização fp8Expiração Dec 2026zai-org/GLM-4.5

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Janela de contexto 131.1K tokensEndpoints compatíveis openaiFornecedor Zhipu

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyAlguns provedoresNão enviado por padrão
include_reasoningTodos os provedores-
max_tokensTodos os provedores-
reasoningTodos os provedores-
response_formatTodos os provedores-
temperatureTodos os provedores0.75
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_kTodos os provedores-
top_pTodos os provedoresNão enviado por padrão

Perguntas frequentes

Modelos similares