M

MiniMax: minimax-m2-her

minimax-m2-her
204.8K contexte2.0K sortieRaisonnementOutilsCache
Publié Jan 23, 2026Limite des connaissances Jun 2025Mis à jour Sep 24, 2026

MiniMax-M2 is a high-efficiency Mixture-of-Experts (MoE) model architected specifically for coding and agentic workflows. While boasting 230B total parameters, it only activates 10B per token, ensuring low latency and high throughput. Its standout feature is "Interleaved Thinking," where the model uses internal reasoning tags (<think>) to plan and self-correct during complex tasks. This makes it exceptionally robust for multi-step tool use, terminal-based coding, and long-horizon planning. It ranks as a top-tier open-weight model, rivaling proprietary giants in agentic benchmarks like VIBE and SWE-bench.

Mode chatTokenizer Other

Tarification

Prix en entrée
$0.60/ 1 M jetons
Prix en sortie
$2.40/ 1 M jetons
Fenêtre de contexte 204.8K jetonsPoints d'accès compatibles openaiÉditeur MiniMax

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyCertains fournisseursNon envoyé par défaut
max_tokensTous les fournisseurs-
temperatureTous les fournisseurs1
top_pTous les fournisseurs0.95

Questions fréquentes

Modèles similaires