A

Alibaba: qwen3.5-flash:free

qwen3.5-flash:free
1M contexto65.5K saídaRaciocínioFerramentasVisãoVídeoEstruturado
Lançado Feb 25, 2026Atualizado Aug 6, 2026

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.

Modo chatTokenizador Qwen3

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Endpoints compatíveis openaiFornecedor Alibaba

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyTodos os provedoresNão enviado por padrão
include_reasoningTodos os provedores-
max_tokensTodos os provedores-
presence_penaltyTodos os provedores-
reasoningTodos os provedores-
response_formatTodos os provedores-
seedTodos os provedores-
stopTodos os provedores-
structured_outputsTodos os provedores-
temperatureTodos os provedoresNão enviado por padrão
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_kTodos os provedores-
top_pTodos os provedoresNão enviado por padrão

Perguntas frequentes

Modelos similares