I

Inception: mercury-2:free

mercury-2:free
128K konteks50K keluaranPenalaranAlatCacheTerstrukturPesan system
Dirilis Mar 4, 2026Diperbarui Jul 8, 2026

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving >1,000 tokens/sec on standard GPUs. Mercury 2 is 5x+ faster than leading speed-optimized LLMs like Claude 4.5 Haiku and GPT 5 Mini, at a fraction of the cost. Mercury 2 supports tunable reasoning levels, 128K context, native tool use, and schema-aligned JSON output. Built for coding workflows where latency compounds, real-time voice/search, and agent loops. OpenAI API compatible. Read more in the blog post.

Mode chatTokenizer Other

Harga

Harga input
$0.00/ 1 J token
Harga output
$0.00/ 1 J token
Jendela konteks 128K tokenEndpoint kompatibel openaiVendor Inception

Waktu aktif

Performa

Memuat data performa...

Penggunaan & Peringkat

Memuat penggunaan...

Parameter didukung

Semua penyedia = didukung oleh setiap upstream yang melayani model ini. Sebagian penyedia = tergantung upstream yang menangani permintaan. Bawaan = nilai yang dikirim saat Anda tidak mengaturnya.

ParameterPenyediaDefault
frequency_penaltySebagian penyediaTidak dikirim secara bawaan
include_reasoningSemua penyedia-
max_tokensSemua penyedia-
presence_penaltySebagian penyediaTidak dikirim secara bawaan
reasoningSemua penyedia-
reasoning_effortSemua penyedia-
repetition_penaltySebagian penyediaTidak dikirim secara bawaan
response_formatSemua penyedia-
stopSemua penyedia-
structured_outputsSemua penyedia-
temperatureSemua penyedia0.75
tool_choiceSemua penyedia-
toolsSemua penyedia-
top_kSebagian penyediaTidak dikirim secara bawaan
top_pSebagian penyediaTidak dikirim secara bawaan

Pertanyaan yang sering diajukan

Model serupa