I

Inception: mercury-2.5:free

mercury-2.5:free
260K contexto65.5K saídaRaciocínioFerramentasFerramentas paralelasCacheEstruturadoMsg sistema
Lançado Sep 8, 2026Atualizado Sep 14, 2026

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving >1,000 tokens/sec on standard GPUs. Mercury 2 is 5x+ faster than leading speed-optimized LLMs like Claude 4.5 Haiku and GPT 5 Mini, at a fraction of the cost. Mercury 2 supports tunable reasoning levels, 128K context, native tool use, and schema-aligned JSON output. Built for coding workflows where latency compounds, real-time voice/search, and agent loops. OpenAI API compatible. Read more in the blog post.

Modo chatTokenizador Other

Preços

Preço de entrada
$0.00/ 1 M tokens
Preço de saída
$0.00/ 1 M tokens
Janela de contexto 128K tokensEndpoints compatíveis openaiFornecedor Inception

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
include_reasoningTodos os provedores-
max_tokensTodos os provedores-
reasoningTodos os provedores-
reasoning_effortTodos os provedores-
response_formatTodos os provedores-
stopTodos os provedores-
structured_outputsTodos os provedores-
temperatureTodos os provedores-
tool_choiceTodos os provedores-
toolsTodos os provedores-

Perguntas frequentes

Modelos similares