A

Alibaba: qwen3.5-flash:free

qwen3.5-flash:free
1M contexte65.5K sortieRaisonnementOutilsVisionVidéoStructuré
Publié Feb 25, 2026Mis à jour Aug 6, 2026

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.

Mode chatTokenizer Qwen3

Tarification

Prix en entrée
$0.00/ 1 M jetons
Prix en sortie
$0.00/ 1 M jetons
Points d'accès compatibles openaiÉditeur Alibaba

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyTous les fournisseursNon envoyé par défaut
include_reasoningTous les fournisseurs-
max_tokensTous les fournisseurs-
presence_penaltyTous les fournisseurs-
reasoningTous les fournisseurs-
response_formatTous les fournisseurs-
seedTous les fournisseurs-
stopTous les fournisseurs-
structured_outputsTous les fournisseurs-
temperatureTous les fournisseursNon envoyé par défaut
tool_choiceTous les fournisseurs-
toolsTous les fournisseurs-
top_kTous les fournisseurs-
top_pTous les fournisseursNon envoyé par défaut

Questions fréquentes

Modèles similaires