I

Inception: mercury-2.5:free

mercury-2.5:free
260K контекст65.5K выводРассуждениеИнструментыПараллельные инструментыКэшСтруктурир.Сист. сообщ.
Выпущено Sep 8, 2026Обновлено Sep 14, 2026

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving >1,000 tokens/sec on standard GPUs. Mercury 2 is 5x+ faster than leading speed-optimized LLMs like Claude 4.5 Haiku and GPT 5 Mini, at a fraction of the cost. Mercury 2 supports tunable reasoning levels, 128K context, native tool use, and schema-aligned JSON output. Built for coding workflows where latency compounds, real-time voice/search, and agent loops. OpenAI API compatible. Read more in the blog post.

Режим chatТокенизатор Other

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Окно контекста 128K токеновСовместимые эндпоинты openaiВендор Inception

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
include_reasoningВсе провайдеры-
max_tokensВсе провайдеры-
reasoningВсе провайдеры-
reasoning_effortВсе провайдеры-
response_formatВсе провайдеры-
stopВсе провайдеры-
structured_outputsВсе провайдеры-
temperatureВсе провайдеры-
tool_choiceВсе провайдеры-
toolsВсе провайдеры-

Часто задаваемые вопросы

Похожие модели