Model head-to-head模型正面对比
The 19 most asked matchups: sourced scores side by side, prices, specs, and a verdict derived from the data — never from sponsorship.
被问得最多的 19 组对决:带来源的成绩并排、价格、规格,以及从数据推导的结论——不受任何厂商赞助。
Claude Opus 5 vs GPT-5.6 Sol
88 93.4 · GPT-5.6 Sol leads领先
Claude Opus 5 vs Gemini 3.1 Pro Preview
88 82.4 · Claude Opus 5 leads领先
GPT-5.6 Sol vs Gemini 3.1 Pro Preview
93.4 82.4 · GPT-5.6 Sol leads领先
Claude Sonnet 5 vs GPT-5.5
83.6 82.9 · Dead heat难分伯仲
Grok 4.5 vs GPT-5.6 Sol
80.5 93.4 · GPT-5.6 Sol leads领先
Grok 4.5 vs Gemini 3.1 Pro Preview
80.5 82.4 · Dead heat难分伯仲
DeepSeek V4 Pro 0423 vs Qwen3.7 Max
86.3 88.5 · Dead heat难分伯仲
Kimi K3 vs GLM 5.2
85.6 86.3 · Dead heat难分伯仲
Kimi K3 vs DeepSeek V4 Pro 0423
85.6 86.3 · Dead heat难分伯仲
Qwen3.7 Max vs GLM 5.2
88.5 86.3 · Dead heat难分伯仲
MiniMax M3 vs GLM 5.2
79.8 86.3 · GLM 5.2 leads领先
DeepSeek V4 Flash 0423 vs Qwen3.7 Plus
82 81.7 · Dead heat难分伯仲
Qwen3.7 Flash vs DeepSeek V4 Flash 0423
81.6 82 · Dead heat难分伯仲
GPT-5.6 Terra vs Gemini 3.6 Flash
87.9 81.1 · GPT-5.6 Terra leads领先
GPT-5.6 Luna vs Gemini 3.1 Flash Lite
83.3 55.7 · GPT-5.6 Luna leads领先
Claude Haiku 4.5 vs GPT-5.6 Luna
51 83.3 · GPT-5.6 Luna leads领先
Llama 4 Maverick vs Qwen3.7 Plus
41.1 81.7 · Qwen3.7 Plus leads领先
Mistral Large vs Command A
48.7 49.2 · Dead heat难分伯仲
Claude Opus 5 vs Claude Opus 4.8
88 84.4 · Claude Opus 5 leads领先
Not sure which pair? Use the constraint solver →拿不定主意?用约束求解器 →