选用模型适用于你的场景。
🏆 第一梯队:顶级推理模型 (60-63分)
Claude Opus 5 (max) - 63
Claude Opus 5 (xhigh) - 63
Claude Fable 5 (with fallback) - 62
Claude Opus 5 (high) - 61
GPT-5.6 Sol (max) - 61
Kimi K3 (max) - 60
🥈 第二梯队:高性能旗舰 (57-59分)
GPT-5.6 Sol (xhigh) 59
Claude Opus 5 (medium) 59
Qwen3.8 Max 59
GPT-5.6 Sol (high) 59
Muse Spark 1.2 (xhigh) 59
GPT-5.6 Terra (max) 59
Grok 4.5 (high) 58
GPT-5.6 Sol (medium) 58
Claude Sonnet 5 (max) - 58
GPT-5.6 Terra (xhigh) 57
🥉 第三梯队:强力中坚 (53-56分)
GLM-5.2 (max) 56
Claude Opus 5 (low) 56
GPT-5.6 Luna (max) 55
DeepSeek V4 Flash 0731 (max) 55
Gemini 3.6 Flash 54
GPT-5.6 Sol (low) 54
GPT-5.6 Terra (high) 53
Kimi K3 (low) 53
Gemini 3.5 Flash (xhigh) - 53
⚖️ 第四梯队:略高于基准 (47-52分)
Minimax M3 52
Minimax M2.5 (medium) - 47
📌 基准线: MiMo-V2.5 的智能得分为 46。以上多个模型/配置在智能程度上优于或等于该基准。从第最后一名开始(如 Claude Haiku 4.5 high、Gemini 2.5 Pro max 等,均为46分及以下),智能程度与 MiMo-V2.5 持平或更低。
