I

InclusionAI: ling-3.0-flash-fin:free

ling-3.0-flash-fin:free
262.1K контекст32.8K выводРассуждениеИнструментыКэшСтруктурир.
Выпущено Jul 23, 2026Обновлено Aug 31, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Режим chatТокенизатор OtherКвантизация bf16inclusionAI/Ling-3.0-flash

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Окно контекста 262.1K токеновСовместимые эндпоинты openaiВендор InclusionAI

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyВсе провайдеры-
include_reasoningВсе провайдеры-
logit_biasВсе провайдеры-
logprobsВсе провайдеры-
max_tokensВсе провайдеры-
min_pВсе провайдеры-
presence_penaltyВсе провайдеры-
reasoningВсе провайдеры-
repetition_penaltyВсе провайдеры-
response_formatВсе провайдеры-
seedВсе провайдеры-
stopВсе провайдеры-
temperatureВсе провайдеры-
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kВсе провайдеры-
top_logprobsВсе провайдеры-
top_pВсе провайдеры-

Часто задаваемые вопросы

Похожие модели