A

Alibaba: qwen3.5-flash:free

qwen3.5-flash:free
1M kontekst65.5K wyjścieRozumowanieNarzędziaWizjaWideoStrukturalne
Wydano Feb 25, 2026Zaktualizowano Aug 6, 2026

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the 3 series, these models deliver a leap forward in performance for both pure text and multimodal tasks, offering fast response times while balancing inference speed and overall performance.

Tryb chatTokenizer Qwen3

Cennik

Cena wejścia
$0.00/ 1 mln tokenów
Cena wyjścia
$0.00/ 1 mln tokenów
Kompatybilne endpointy openaiDostawca Alibaba

Czas dostępności

Wydajność

Ładowanie danych wydajności...

Użycie i ranking

Ładowanie użycia...

Obsługiwane parametry

Wszyscy dostawcy = obsługiwany przez każdy upstream serwujący ten model. Niektórzy dostawcy = zależy od upstreamu obsługującego żądanie. Domyślnie = wartość wysyłana, gdy nic nie ustawisz.

ParametrDostawcyDomyślne
frequency_penaltyWszyscy dostawcyDomyślnie niewysyłany
include_reasoningWszyscy dostawcy-
max_tokensWszyscy dostawcy-
presence_penaltyWszyscy dostawcy-
reasoningWszyscy dostawcy-
response_formatWszyscy dostawcy-
seedWszyscy dostawcy-
stopWszyscy dostawcy-
structured_outputsWszyscy dostawcy-
temperatureWszyscy dostawcyDomyślnie niewysyłany
tool_choiceWszyscy dostawcy-
toolsWszyscy dostawcy-
top_kWszyscy dostawcy-
top_pWszyscy dostawcyDomyślnie niewysyłany

Często zadawane pytania

Podobne modele