I

Inception: mercury-2:free

mercury-2:free
128K contexto50K saídaRaciocínioFerramentasCacheEstruturadoMsg sistema
Lançado Mar 4, 2026Atualizado Jul 8, 2026

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving >1,000 tokens/sec on standard GPUs. Mercury 2 is 5x+ faster than leading speed-optimized LLMs like Claude 4.5 Haiku and GPT 5 Mini, at a fraction of the cost. Mercury 2 supports tunable reasoning levels, 128K context, native tool use, and schema-aligned JSON output. Built for coding workflows where latency compounds, real-time voice/search, and agent loops. OpenAI API compatible. Read more in the blog post.

Modo chatTokenizador Other

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Janela de contexto 128K tokensEndpoints compatíveis openaiFornecedor Inception

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyAlguns provedoresNão enviado por padrão
include_reasoningTodos os provedores-
max_tokensTodos os provedores-
presence_penaltyAlguns provedoresNão enviado por padrão
reasoningTodos os provedores-
reasoning_effortTodos os provedores-
repetition_penaltyAlguns provedoresNão enviado por padrão
response_formatTodos os provedores-
stopTodos os provedores-
structured_outputsTodos os provedores-
temperatureTodos os provedores0.75
tool_choiceTodos os provedores-
toolsTodos os provedores-
top_kAlguns provedoresNão enviado por padrão
top_pAlguns provedoresNão enviado por padrão

Perguntas frequentes

Modelos similares