🏆 模型排行榜

综合评估各维度表现,帮您快速找到最适合的开源大模型

UPDATE
🥇
Claude Opus 4.5 新晋榜首
Anthropic
综合得分 73.6 ★★★★☆
🥈
Gemini 3 Pro
Google
综合得分 69.8 ★★★☆☆
🥉
GPT 5.1 Codex Max
OpenAI
综合得分 69.4 ★★★☆☆
4
Claude Sonnet 4.5
Anthropic
综合得分 69.3 ★★★☆☆
5
Claude 4.1 Opus
Anthropic
综合得分 68.0 ★★★☆☆
6
GPT 5.2
OpenAI
综合得分 68.0 ★★★☆☆
7
Deepseek V3.2
DeepSeek
综合得分 65.3 ★★★☆☆
8
GPT 5.1
OpenAI
综合得分 65.3 ★★★☆☆
9
GPT 5 Mini
OpenAI
综合得分 64.1 ★★★☆☆
10
GPT 5 Pro
OpenAI
综合得分 63.6 ★★★☆☆
11
GPT 5.1 Codex
OpenAI
综合得分 63.4 ★★★☆☆
12
Gemini 3 Flash Minimal
Google
综合得分 63.0 ★★★☆☆
13
Claude 4 Sonnet
Anthropic
综合得分 62.9 ★★★☆☆
14
Claude Haiku 4.5
Anthropic
综合得分 62.7 ★★★☆☆
15
Devstral 2512
Community
综合得分 60.9 ★★★☆☆
16
Gemini 3 Flash
Google
综合得分 58.2 ★★★☆☆
17
Deepseek V3.2 Exp
DeepSeek
综合得分 57.8 ★★★☆☆
18
Kimi K2 Thinking
Moonshot
综合得分 57.5 ★★★☆☆
19
GPT 5.1 Codex Mini
OpenAI
综合得分 57.5 ★★★☆☆
20
Kimi K2
Moonshot
综合得分 57.1 ★★★☆☆
21
GLM 4.6
智谱 AI
综合得分 56.8 ★★★☆☆
22
Gemini 2.5 Pro 06 05 Thinking
Google
综合得分 56.6 ★★★☆☆

CURRENT MODEL

Claude Opus 4.5

排名 #1

在 LiveBench 编码评测中位列 #1,综合得分 73.6。

Arena 得分: 73.6 (原始 74)
上下文窗口: —
组织: Anthropic
许可证: —
官方价格 暂无官方价格

SELECT ACTIVE GATEWAYS

● 链路已加密校验
所有数据均来自公开测试,实际效果可能因使用方式和场景而异