MiniMax: minimax-m2-her
MiniMax-M2 is a high-efficiency Mixture-of-Experts (MoE) model architected specifically for coding and agentic workflows. While boasting 230B total parameters, it only activates 10B per token, ensuring low latency and high throughput. Its standout feature is "Interleaved Thinking," where the model uses internal reasoning tags (<think>) to plan and self-correct during complex tasks. This makes it exceptionally robust for multi-step tool use, terminal-based coding, and long-horizon planning. It ranks as a top-tier open-weight model, rivaling proprietary giants in agentic benchmarks like VIBE and SWE-bench.
Giá cả
Thời gian hoạt động
Hiệu năng
Sử dụng & Xếp hạng
Tham số hỗ trợ
Tất cả nhà cung cấp = mọi upstream phục vụ mô hình này đều hỗ trợ. Một số nhà cung cấp = tùy thuộc upstream xử lý yêu cầu. Mặc định = giá trị được gửi khi bạn không thiết lập.
| Tham số | Nhà cung cấp | Mặc định |
|---|---|---|
| frequency_penalty | Một số nhà cung cấp | Mặc định không gửi |
| max_tokens | Tất cả nhà cung cấp | - |
| temperature | Tất cả nhà cung cấp | 1 |
| top_p | Tất cả nhà cung cấp | 0.95 |