M

MiniMax: minimax-m2-her

minimax-m2-her
204.8K contexto2.0K salidaRazonamientoHerramientasCaché
Lanzado Jan 23, 2026Corte de conocimiento Jun 2025Actualizado Sep 24, 2026

MiniMax-M2 is a high-efficiency Mixture-of-Experts (MoE) model architected specifically for coding and agentic workflows. While boasting 230B total parameters, it only activates 10B per token, ensuring low latency and high throughput. Its standout feature is "Interleaved Thinking," where the model uses internal reasoning tags (<think>) to plan and self-correct during complex tasks. This makes it exceptionally robust for multi-step tool use, terminal-based coding, and long-horizon planning. It ranks as a top-tier open-weight model, rivaling proprietary giants in agentic benchmarks like VIBE and SWE-bench.

Modo chatTokenizador Other

Precios

Precio de entrada
$0.60/ 1 M tokens
Precio de salida
$2.40/ 1 M tokens
Ventana de contexto 204.8K tokensEndpoints compatibles openaiProveedor MiniMax

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyAlgunos proveedoresNo se envía por defecto
max_tokensTodos los proveedores-
temperatureTodos los proveedores1
top_pTodos los proveedores0.95

Preguntas frecuentes

Modelos similares