LINUX SB 快照站

做一个ai模型性能排行(主流)

原帖: linux.sb/topic/10724 · 共 14 楼 · 标题快照 2026-08-12 10:35:46

楼主
发帖 2026-08-10 17:15:18 · 快照 2026-08-12 10:35:46

选用模型适用于你的场景。

🏆 第一梯队:顶级推理模型 (60-63分)
Claude Opus 5 (max) - 63
Claude Opus 5 (xhigh) - 63
Claude Fable 5 (with fallback) - 62
Claude Opus 5 (high) - 61
GPT-5.6 Sol (max) - 61
Kimi K3 (max) - 60

🥈 第二梯队:高性能旗舰 (57-59分)
GPT-5.6 Sol (xhigh) 59
Claude Opus 5 (medium) 59
Qwen3.8 Max 59
GPT-5.6 Sol (high) 59
Muse Spark 1.2 (xhigh) 59
GPT-5.6 Terra (max) 59
Grok 4.5 (high) 58
GPT-5.6 Sol (medium) 58
Claude Sonnet 5 (max) - 58
GPT-5.6 Terra (xhigh) 57

🥉 第三梯队:强力中坚 (53-56分)
GLM-5.2 (max) 56
Claude Opus 5 (low) 56
GPT-5.6 Luna (max) 55
DeepSeek V4 Flash 0731 (max) 55
Gemini 3.6 Flash 54
GPT-5.6 Sol (low) 54
GPT-5.6 Terra (high) 53
Kimi K3 (low) 53
Gemini 3.5 Flash (xhigh) - 53

⚖️ 第四梯队:略高于基准 (47-52分)
Minimax M3 52
Minimax M2.5 (medium) - 47

📌 基准线: MiMo-V2.5 的智能得分为 46。以上多个模型/配置在智能程度上优于或等于该基准。从第最后一名开始(如 Claude Haiku 4.5 high、Gemini 2.5 Pro max 等,均为46分及以下),智能程度与 MiMo-V2.5 持平或更低。

#2
发帖 2026-08-10 17:19:26 · 快照 2026-08-12 10:35:46

DeepSeek V4 Pro惨遭除名

#3
发帖 2026-08-10 17:20:10 · 快照 2026-08-12 10:35:46

opus 5和肥波到底怎么样

#4
发帖 2026-08-10 17:22:33 · 快照 2026-08-12 10:35:46

@aierkuite #3 就是那种你安排一个小弟去干活等着收钱贼放心的那种

#5
发帖 2026-08-10 17:23:21 · 快照 2026-08-12 10:35:46

@快速 Kimi K3 (max) 没用过。真的这么强?

#6
发帖 2026-08-10 17:28:33 · 快照 2026-08-12 10:35:46

@crnet #5 是滴

#7
发帖 2026-08-10 17:30:23 · 快照 2026-08-12 10:35:46

算了,心凉了

#8
发帖 2026-08-10 17:36:06 · 快照 2026-08-12 10:35:46

@Yan #8 我记得Opus5刚发布的时候A\确实说max比Fable强

#9
发帖 2026-08-10 17:41:04 · 快照 2026-08-12 10:35:46

@Yan #8 肥波网络漏洞猛,这个是综合打分

#10
发帖 2026-08-10 18:00:16 · 快照 2026-08-12 10:35:46

grok 4.5不配拥有名字吗?

#11
发帖 2026-08-10 18:07:20 · 快照 2026-08-12 10:35:46

opus 5是不是太高了

#12
发帖 2026-08-10 18:27:32 · 快照 2026-08-12 10:35:46

@noxye #11 @noxye #11 已改正,我服了,qwen3.8给我做的总结,错了一大堆

#13
发帖 2026-08-10 18:39:39 · 快照 2026-08-12 10:35:46

以此图为准