A

Alibaba: qwen3.5-flash:free

qwen3.5-flash:free
1M contexto65.5K salidaRazonamientoHerramientasVisiónVideoEstructurado
Lanzado Feb 25, 2026Actualizado Aug 6, 2026

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.

Modo chatTokenizador Qwen3

Precios

Precio de entrada
$0.00/ 1 M tokens
Precio de salida
$0.00/ 1 M tokens
Endpoints compatibles openaiProveedor Alibaba

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedoresNo se envía por defecto
include_reasoningTodos los proveedores-
max_tokensTodos los proveedores-
presence_penaltyTodos los proveedores-
reasoningTodos los proveedores-
response_formatTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
structured_outputsTodos los proveedores-
temperatureTodos los proveedoresNo se envía por defecto
tool_choiceTodos los proveedores-
toolsTodos los proveedores-
top_kTodos los proveedores-
top_pTodos los proveedoresNo se envía por defecto

Preguntas frecuentes

Modelos similares