M

MiniMax: minimax-m2-her

minimax-m2-her
204.8K contexto2.0K saídaRaciocínioFerramentasCache
Lançado Jan 23, 2026Corte de conhecimento Jun 2025Atualizado Sep 24, 2026

MiniMax-M2 is a high-efficiency Mixture-of-Experts (MoE) model architected specifically for coding and agentic workflows. While boasting 230B total parameters, it only activates 10B per token, ensuring low latency and high throughput. Its standout feature is "Interleaved Thinking," where the model uses internal reasoning tags (<think>) to plan and self-correct during complex tasks. This makes it exceptionally robust for multi-step tool use, terminal-based coding, and long-horizon planning. It ranks as a top-tier open-weight model, rivaling proprietary giants in agentic benchmarks like VIBE and SWE-bench.

Modo chatTokenizador Other

Preços

Preço de entrada
$0.60/ 1 M tokens
Preço de saída
$2.40/ 1 M tokens
Janela de contexto 204.8K tokensEndpoints compatíveis openaiFornecedor MiniMax

Tempo de atividade

Desempenho

Carregando dados de desempenho...

Uso e classificação

Carregando uso...

Parâmetros suportados

Todos os provedores = compatível em todos os upstreams que servem este modelo. Alguns provedores = depende do upstream que atende a solicitação. Padrão = o valor enviado quando você não define nada.

ParâmetroProvedoresPadrão
frequency_penaltyAlguns provedoresNão enviado por padrão
max_tokensTodos os provedores-
temperatureTodos os provedores1
top_pTodos os provedores0.95

Perguntas frequentes

Modelos similares