A
Alibaba: qwen3.5-flash:free
qwen3.5-flash:free
1M contexte65.5K sortieRaisonnementOutilsVisionVidéoStructuré
Publié Feb 25, 2026Mis à jour Aug 6, 2026
The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.
Mode chatTokenizer Qwen3
Tarification
Prix en entrée
$0.00/ 1 M jetons
Prix en sortie
$0.00/ 1 M jetons
Points d'accès compatibles openaiÉditeur Alibaba
Disponibilité
Performance
Chargement des performances...
Utilisation et classement
Chargement de l'utilisation...
Paramètres supportés
Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.
| Paramètre | Fournisseurs | Par défaut |
|---|---|---|
| frequency_penalty | Tous les fournisseurs | Non envoyé par défaut |
| include_reasoning | Tous les fournisseurs | - |
| max_tokens | Tous les fournisseurs | - |
| presence_penalty | Tous les fournisseurs | - |
| reasoning | Tous les fournisseurs | - |
| response_format | Tous les fournisseurs | - |
| seed | Tous les fournisseurs | - |
| stop | Tous les fournisseurs | - |
| structured_outputs | Tous les fournisseurs | - |
| temperature | Tous les fournisseurs | Non envoyé par défaut |
| tool_choice | Tous les fournisseurs | - |
| tools | Tous les fournisseurs | - |
| top_k | Tous les fournisseurs | - |
| top_p | Tous les fournisseurs | Non envoyé par défaut |