I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K контекст32.8K выводРассуждениеИнструментыВидеоКэшСтруктурир.
Выпущено Sep 10, 2026Обновлено Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Режим chatТокенизатор OtherКвантизация fp16inclusionAI/Ling-3.0-flash-VL

Все провайдеры этой модели сейчас заняты

Каждый вышестоящий провайдер достиг своего лимита запросов. Модель вернётся автоматически, как только лимиты снимутся, обычно в течение нескольких часов. Попробуйте позже или переключитесь на другую модель.

Запросить эту модель в Discord

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Окно контекста 262.1K токеновСовместимые эндпоинты -Вендор InclusionAI

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyВсе провайдеры-
include_reasoningВсе провайдеры-
logit_biasВсе провайдеры-
max_tokensВсе провайдеры-
min_pВсе провайдеры-
presence_penaltyВсе провайдеры-
reasoningВсе провайдеры-
repetition_penaltyВсе провайдеры-
response_formatВсе провайдеры-
seedВсе провайдеры-
stopВсе провайдеры-
structured_outputsВсе провайдеры-
temperatureВсе провайдеры-
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kВсе провайдеры-
top_pВсе провайдеры-

Часто задаваемые вопросы

Похожие модели