InclusionAI: ling-3.0-flash-vl:free
Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.
Все провайдеры этой модели сейчас заняты
Каждый вышестоящий провайдер достиг своего лимита запросов. Модель вернётся автоматически, как только лимиты снимутся, обычно в течение нескольких часов. Попробуйте позже или переключитесь на другую модель.
Запросить эту модель в DiscordТарифы
Время работы
Производительность
Использование и рейтинг
Поддерж. параметры
Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.
| Параметр | Провайдеры | По умолчанию |
|---|---|---|
| frequency_penalty | Все провайдеры | - |
| include_reasoning | Все провайдеры | - |
| logit_bias | Все провайдеры | - |
| max_tokens | Все провайдеры | - |
| min_p | Все провайдеры | - |
| presence_penalty | Все провайдеры | - |
| reasoning | Все провайдеры | - |
| repetition_penalty | Все провайдеры | - |
| response_format | Все провайдеры | - |
| seed | Все провайдеры | - |
| stop | Все провайдеры | - |
| structured_outputs | Все провайдеры | - |
| temperature | Все провайдеры | - |
| tool_choice | Все провайдеры | - |
| tools | Все провайдеры | - |
| top_k | Все провайдеры | - |
| top_p | Все провайдеры | - |