模型智能能力 · 多维天梯

中文能力

评估模型中文理解、生成与知识应用水平

数据更新于 2026-07-31 · 能力库 206 条(网关 49 · 站外 157 · AA 173 · Arena 100 · 当前榜 54 · OpenRouter 实时已接入 · 知识库 159 模 / 31 族 / 26 维

中文能力 配图

模型天梯 · region

中文能力

本榜单聚焦大模型在中文场景下的综合表现,涵盖阅读理解、文本生成、知识问答、逻辑推理及文化适应性等维度。数据来源于公开中文基准测试(如C-Eval、CMMLU)、中文Arena对战结果、实际API使用量统计以及领域启发式评估。解读时需结合具体任务类型,注意不同基准侧重点差异,避免单一分数决定选型,建议参考多维度交叉验证。

  • 多基准加权平均(C-Eval、CMMLU等)
  • 中文特有任务与文化适应性评分
  • 用户真实用量与反馈集成
显示 54全量 54

列表 54 / 54(全库 54)· 点击「佐证」查看评分依据与测试题面

🥈
Kimi K3
moonshotai · 中国
62 综合分
#模型厂商地区综合分相对说明证据源佐证
🥇qwen3.5:4b
qwen3.5:4b
qwen中国网关90
qwen
中国大模型
探测
查看佐证
🥈Kimi K3
moonshotai/kimi-k3
moonshotai中国62
moonshotai
中国大模型
AAOR站外对照
查看佐证
🥉qwen3.6:27b
qwen3.6:27b
qwen中国网关61
qwen
中国大模型
探测AAOR
查看佐证
4GLM 5.2
z-ai/glm-5.2
z-ai中国56
z-ai
中国大模型
AAOR站外对照
查看佐证
5Kimi K3 (max)
aa/kimi-k3-max
Kimi中国56
Kimi
中国大模型
AA快照站外对照Arena
查看佐证
6DeepSeek V4 Flash 0731
deepseek/deepseek-v4-flash-0731
deepseek中国55
deepseek
中国大模型
AAOR站外对照
查看佐证
7qwen3.6:35b-a3b
qwen3.6:35b-a3b
qwen中国网关55
qwen
中国大模型
探测AAOR
查看佐证
8Qwen3.7 Max
qwen/qwen3.7-max
qwen中国51
qwen
中国大模型
AAOR站外对照
查看佐证
9GLM-5.2 (max)
aa/glm-5.2-max
Z AI中国50
Z AI
中国大模型
AA快照站外对照Arena
查看佐证
10Kimi K2.6
moonshotai/kimi-k2.6
moonshotai中国49
moonshotai
中国大模型
AAOR站外对照
查看佐证
11MiniMax M3
minimax/minimax-m3
minimax中国48
minimax
中国大模型
AAOR站外对照
查看佐证
12Kimi K2.7 Code
moonshotai/kimi-k2.7-code
moonshotai中国47
moonshotai
中国大模型
AAOR站外对照
查看佐证
13MiMo-V2.5-Pro
xiaomi/mimo-v2.5-pro
xiaomi中国47
xiaomi
中国大模型
AAOR站外对照
查看佐证
14Hy3 preview
tencent/hy3-preview
tencent中国46
tencent
中国大模型
AAOR站外对照
查看佐证
15Kimi K3 (low)
aa/kimi-k3-low
Kimi中国46
Kimi
中国大模型
AA快照站外对照Arena
查看佐证
16GLM 5.1
z-ai/glm-5.1
z-ai中国44
z-ai
中国大模型
AAOR站外对照
查看佐证
17Qwen3.6 Plus
qwen/qwen3.6-plus
qwen中国44
qwen
中国大模型
AAOR站外对照
查看佐证
18DeepSeek V4 Pro (max)
aa/deepseek-v4-pro-max
DeepSeek中国43
DeepSeek
中国大模型
AA快照站外对照Arena
查看佐证
19Qwen3.7 Plus
qwen/qwen3.7-plus
qwen中国43
qwen
中国大模型
AAOR站外对照
查看佐证
20DeepSeek V4 Pro (high)
aa/deepseek-v4-pro-high
DeepSeek中国42
DeepSeek
中国大模型
AA快照站外对照Arena
查看佐证
21MiMo-V2.5
xiaomi/mimo-v2.5
xiaomi中国42
xiaomi
中国大模型
AAOR站外对照
查看佐证
22MiniMax M2.7
minimax/minimax-m2.7
minimax中国42
minimax
中国大模型
AAOR站外对照
查看佐证
23KAT-Coder-Pro V2
kwaipilot/kat-coder-pro-v2
kwaipilot中国41
kwaipilot
中国大模型
AAOR站外对照
查看佐证
24Hy3
aa/hy3
Tencent中国40
Tencent
中国大模型
AA快照站外对照Arena
查看佐证
25DeepSeek V4 Flash (max)
aa/deepseek-v4-flash-max
DeepSeek中国39
DeepSeek
中国大模型
AA快照站外对照Arena
查看佐证
26Kimi K2.5
moonshotai/kimi-k2.5
moonshotai中国38
moonshotai
中国大模型
AAOR站外对照
查看佐证
27Qwen3.5 397B A17B
qwen/qwen3.5-397b-a17b
qwen中国38
qwen
中国大模型
AAOR站外对照
查看佐证
28GLM 4.7
z-ai/glm-4.7
z-ai中国37
z-ai
中国大模型
AAOR站外对照
查看佐证
29DeepSeek V4 Flash (high)
aa/deepseek-v4-flash-high
DeepSeek中国36
DeepSeek
中国大模型
AA快照站外对照Arena
查看佐证
30deepseek-v4-pro
deepseek-v4-pro
deepseek中国网关36
deepseek
中国大模型
探测AAOR
查看佐证
31Qwen3.5-122B-A10B
qwen/qwen3.5-122b-a10b
qwen中国36
qwen
中国大模型
AAOR站外对照
查看佐证
32DeepSeek V3.2
deepseek/deepseek-v3.2
deepseek中国35
deepseek
中国大模型
AAOR站外对照
查看佐证
33MiMo-V2-Omni-0327
aa/mimo-v2-omni-0327
Xiaomi中国35
Xiaomi
中国大模型
AA快照站外对照
查看佐证
34DeepSeek V3.1 Terminus
deepseek/deepseek-v3.1-terminus
deepseek中国34
deepseek
中国大模型
AAOR站外对照
查看佐证
35MiMo-V2-Omni
aa/mimo-v2-omni
Xiaomi中国34
Xiaomi
中国大模型
AA快照站外对照
查看佐证
36Ring-2.6-1T
inclusionai/ring-2.6-1t
inclusionai中国34
inclusionai
中国大模型
AAOR站外对照
查看佐证
37deepseek-v4-flash
deepseek-v4-flash
deepseek中国网关33
deepseek
中国大模型
探测OR快照OR
查看佐证
38GLM 4.6
z-ai/glm-4.6
z-ai中国33
z-ai
中国大模型
AAOR站外对照
查看佐证
39Step 3.7 Flash
stepfun/step-3.7-flash
stepfun中国33
stepfun
中国大模型
AAOR站外对照
查看佐证
40MiMo-V2-Flash (Feb 2026)
aa/mimo-v2-flash-feb-2026
Xiaomi中国32
Xiaomi
中国大模型
AA快照站外对照
查看佐证
41Qwen3.5 Omni Plus
aa/qwen3.5-omni-plus
Alibaba中国30
Alibaba
中国大模型
AA快照站外对照
查看佐证
42Qwen3.5-35B-A3B
qwen/qwen3.5-35b-a3b
qwen中国28
qwen
中国大模型
AAOR站外对照
查看佐证
43Qwen3 Coder Next
qwen/qwen3-coder-next
qwen中国25
qwen
中国大模型
AAOR站外对照
查看佐证
44Qwen3.5-9B
qwen/qwen3.5-9b
qwen中国23
qwen
中国大模型
AAOR站外对照
查看佐证
45Qwen3 235B A22B Thinking 2507
qwen/qwen3-235b-a22b-thinking-2507
qwen中国20
qwen
中国大模型
AAOR站外对照
查看佐证
46R1
deepseek/deepseek-r1
deepseek中国20
deepseek
中国大模型
AAOR站外对照
查看佐证
47Kimi K2 Thinking
moonshotai/kimi-k2-thinking
moonshotai中国18
moonshotai
中国大模型
AAOR站外对照
查看佐证
48DeepSeek V3 0324
deepseek/deepseek-chat-v3-0324
deepseek中国17
deepseek
中国大模型
AAOR站外对照
查看佐证
49Ling-2.6-flash
inclusionai/ling-2.6-flash
inclusionai中国17
inclusionai
中国大模型
AAOR站外对照
查看佐证
50Qwen3 Next 80B A3B Thinking
qwen/qwen3-next-80b-a3b-thinking
qwen中国17
qwen
中国大模型
AAOR站外对照
查看佐证
51Qwen3 30B A3B Thinking 2507
qwen/qwen3-30b-a3b-thinking-2507
qwen中国14
qwen
中国大模型
AAOR站外对照
查看佐证
52Qwen3 32B
qwen/qwen3-32b
qwen中国12
qwen
中国大模型
AAOR站外对照
查看佐证
53Qwen3 14B
qwen/qwen3-14b
qwen中国11
qwen
中国大模型
AAOR站外对照
查看佐证
54Qwen3 8B
qwen/qwen3-8b
qwen中国8
qwen
中国大模型
AAOR站外对照
查看佐证

启发式维度(中文/英文/OCR/软件等)在无官方公开 bench 时由厂商归属、模态与关联模型热度估算,仅供选型参考; 客观能力以 AA 智力/代码/Agent 与本站实测为准。交叉验证: 用量榜 · 模型目录 · 实验室

GrokCode 中文能力天梯 | 中文模型排名与基准对比 · GrokCode 倍率榜