I

Inception: mercury-2:free

mercury-2:free
128K контекст50K выводРассуждениеИнструментыКэшСтруктурир.Сист. сообщ.
Выпущено Mar 4, 2026Обновлено Jul 8, 2026

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving >1,000 tokens/sec on standard GPUs. Mercury 2 is 5x+ faster than leading speed-optimized LLMs like Claude 4.5 Haiku and GPT 5 Mini, at a fraction of the cost. Mercury 2 supports tunable reasoning levels, 128K context, native tool use, and schema-aligned JSON output. Built for coding workflows where latency compounds, real-time voice/search, and agent loops. OpenAI API compatible. Read more in the blog post.

Режим chatТокенизатор Other

Тарифы

Цена за вход
$0.00/ 1 млн токенов
Цена за выход
$0.00/ 1 млн токенов
Окно контекста 128K токеновСовместимые эндпоинты openaiВендор Inception

Время работы

Производительность

Загрузка данных производительности...

Использование и рейтинг

Загрузка использования...

Поддерж. параметры

Все провайдеры = поддерживается каждым апстримом, обслуживающим эту модель. Некоторые провайдеры = зависит от апстрима, обрабатывающего запрос. По умолчанию = значение, отправляемое, если вы ничего не задали.

ПараметрПровайдерыПо умолчанию
frequency_penaltyНекоторые провайдерыПо умолчанию не отправляется
include_reasoningВсе провайдеры-
max_tokensВсе провайдеры-
presence_penaltyНекоторые провайдерыПо умолчанию не отправляется
reasoningВсе провайдеры-
reasoning_effortВсе провайдеры-
repetition_penaltyНекоторые провайдерыПо умолчанию не отправляется
response_formatВсе провайдеры-
stopВсе провайдеры-
structured_outputsВсе провайдеры-
temperatureВсе провайдеры0.75
tool_choiceВсе провайдеры-
toolsВсе провайдеры-
top_kНекоторые провайдерыПо умолчанию не отправляется
top_pНекоторые провайдерыПо умолчанию не отправляется

Часто задаваемые вопросы

Похожие модели