A
Alibaba: qwen3.5-flash:free
qwen3.5-flash:free
1M contexto65.5K saídaRaciocínioFerramentasVisãoVídeoEstruturado
Lançado Feb 25, 2026Atualizado Aug 6, 2026
The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.
Modo chatTokenizador Qwen3
Preços
Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Endpoints compatíveis openaiFornecedor Alibaba
Tempo de atividade
Desempenho
Carregando dados de desempenho...
Uso e classificação
Carregando uso...
Parâmetros suportados
Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.
| Parâmetro | Provedores | Padrão |
|---|---|---|
| frequency_penalty | Todos os provedores | Não enviado por padrão |
| include_reasoning | Todos os provedores | - |
| max_tokens | Todos os provedores | - |
| presence_penalty | Todos os provedores | - |
| reasoning | Todos os provedores | - |
| response_format | Todos os provedores | - |
| seed | Todos os provedores | - |
| stop | Todos os provedores | - |
| structured_outputs | Todos os provedores | - |
| temperature | Todos os provedores | Não enviado por padrão |
| tool_choice | Todos os provedores | - |
| tools | Todos os provedores | - |
| top_k | Todos os provedores | - |
| top_p | Todos os provedores | Não enviado por padrão |