🥇
qwen3.6:35b-a3bqwen · 中国
85 实测总分
0.83s
本站網關真實探測. GrokCode 私榜:free/basic 池实测与探测——延迟、多步、长 Agent、工具。与公榜 Intelligence Index 口径不同,用于看本站网关能不能打。
更新:数据更新于 2026-08-03 · AA 301 · gateway 49 · 44 · OpenRouter live · 現網公榜

模型天梯 · local
本站網關真實探測
| # | 模型 | 厂商 | 地区 | 实测总分 | 相对 | 说明 | 证据源 | 佐证 |
|---|---|---|---|---|---|---|---|---|
| 🥇 | qwen3.6:35b-a3b qwen3.6:35b-a3b | qwen | 中国网关 | 85 | 0.83s 多维探测 · 延迟 0.83s · 算对 · 推理对 · 多步OK | 探测AAOR | 查看佐证 | |
| 🥈 | grok-4.20-0309-non-reasoning-console grok-4.20-0309-non-reasoning-console | x-ai | 美国网关 | 84 | 0.68s console 里最快;有引用链接 | 实测OR | 查看佐证 | |
| 🥉 | qwen3.5:4b qwen3.5:4b | qwen | 中国网关 | 83 | 1.00s 多维探测 · 延迟 1.00s · 算对 · 推理对 · 多步OK | 探测AA快照 | 查看佐证 | |
| 4 | gpt-4.1-nano-2025-04-14 gpt-4.1-nano-2025-04-14 | openai | 美国网关 | 82 | 0.93s 多维探测 · 延迟 0.93s · 算对 · 推理对 · 多步OK | 探测OR快照 | 查看佐证 | |
| 5 | grok-3 grok-3 | xai | 美国网关 | 82 | 1.08s 多维探测 · 延迟 1.08s · 算对 · 推理对 · 多步OK | 探测 | 查看佐证 | |
| 6 | grok-4.20-0309-non-reasoning grok-4.20-0309-non-reasoning | x-ai | 美国网关 | 82 | 0.41s 唯一稳定返回 client tool_calls;推理有时飘 | 实测OR | 查看佐证 | |
| 7 | grok-4.3-fast grok-4.3-fast | xai | 美国网关 | 79 | 0.40s 最快可用;推理实测正确;联网无引用 · Arena#38 | 实测OR快照Arena | 查看佐证 | |
| 8 | grok-4.20-0309-reasoning-console grok-4.20-0309-reasoning-console | x-ai | 美国网关 | 78 | 1.90s 0309 reasoning + 联网 | 实测OR | 查看佐证 | |
| 9 | grok-4.3-medium grok-4.3-medium | xai | 美国网关 | 78 | 1.96s 联网引用 + 推理稳,性价比高 · Arena#38 | 实测OR快照Arena | 查看佐证 | |
| 10 | qwen3.6:27b qwen3.6:27b | qwen | 中国网关 | 78 | 1.43s 多维探测 · 延迟 1.43s · 算对 · 推理对 · 多步OK | 探测AAOR | 查看佐证 | |
| 11 | gpt-5.4-mini gpt-5.4-mini | openai | 美国网关 | 77 | 1.40s 多维探测 · 延迟 1.40s · 算对 · 推理对 · 多步OK · Arena Agent #16 (net +5.1%) | 探测AAOR | 查看佐证 | |
| 12 | grok-4.3-high grok-4.3-high | xai | 美国网关 | 77 | 2.04s 能力最强档之一;慢于 medium 有限 · Arena#38 | 实测OR快照Arena | 查看佐证 | |
| 13 | gemini-3-5-flash-low gemini-3-5-flash-low | 美国网关 | 76 | 1.41s 多维探测 · 延迟 1.41s · 算对 · 推理对 · 多步OK | 探测OR快照 | 查看佐证 | ||
| 14 | lingsi1.0 lingsi1.0 | other | —网关 | 76 | 1.65s 多维探测 · 延迟 1.65s · 算对 · 推理对 · 多步OK | 探测 | 查看佐证 | |
| 15 | grok-4.20-0309-console grok-4.20-0309-console | xai | 美国网关 | 75 | 2.18s 全能,无特殊短板 | 实测 | 查看佐证 | |
| 16 | gpt-4.1-nano gpt-4.1-nano | openai | 美国网关 | 74 | 1.63s 多维探测 · 延迟 1.63s · 算对 · 推理对 · 多步OK | 探测AAOR | 查看佐证 | |
| 17 | grok-4.3-low grok-4.3-low | xai | 美国网关 | 74 | 2.28s 思考档位 low,质量略逊 medium · Arena#38 | 实测OR快照Arena | 查看佐证 | |
| 18 | grok-4.20-multi-agent-console grok-4.20-multi-agent-console | x-ai | 美国网关 | 73 | 1.98s 多代理;配额/占槽更重 | 实测OR | 查看佐证 | |
| 19 | grok-composer-2.5-fast grok-composer-2.5-fast | xai | 美国网关 | 73 | 2.10s 多维探测 · 延迟 2.10s · 算对 · 推理对 · 多步OK | 探测 | 查看佐证 | |
| 20 | grok-4.3-console grok-4.3-console | xai | 美国网关 | 72 | 2.81s 综合强;短句延迟略高 · Arena#38 | 实测OR快照Arena | 查看佐证 | |
| 21 | grok-4.20-multi-agent-high grok-4.20-multi-agent-high | x-ai | 美国网关 | 69 | 2.42s 更吃配额与时间 | 实测OR | 查看佐证 | |
| 22 | grok-4.5 grok-4.5 | x-ai | 美国网关 | 67 | 2.36s 多维探测 · 延迟 2.36s · 算对 · 推理对 · 多步OK · Arena Agent #14 (net +5.5%) | 探测AAOR | 查看佐证 | |
| 23 | grok-4.20-fast grok-4.20-fast | xai | 美国网关 | 66 | 1.28s 延迟波动大;9.11/9.9 题答错 | 实测 | 查看佐证 | |
| 24 | grok-4.20-multi-agent-medium grok-4.20-multi-agent-medium | x-ai | 美国网关 | 66 | 2.99s 适合低并发精做 | 实测OR | 查看佐证 | |
| 25 | grok-4.20-multi-agent-xhigh grok-4.20-multi-agent-xhigh | x-ai | 美国网关 | 63 | 3.15s 最慢最重;勿高并发 | 实测OR | 查看佐证 | |
| 26 | grok-4.3 grok-4.3 | x-ai | 美国网关 | 63 | 2.73s 多维探测 · 延迟 2.73s · 算对 · 推理对 · 多步OK · Arena Agent #38 (net +8.0%) | 探测AAOR | 查看佐证 | |
| 27 | composer-2.5 composer-2.5 | cursor | —网关 | 62 | 3.05s 多维探测 · 延迟 3.05s · 算对 · 推理对 · 多步OK | 探测 | 查看佐证 | |
| 28 | grok-build-0.1 grok-build-0.1 | x-ai | 美国网关 | 62 | 2.81s 多维探测 · 延迟 2.81s · 算对 · 推理对 · 多步OK · Arena Agent #37 (net +8.0%) | 探测AAOR | 查看佐证 | |
| 29 | gpt-5.4 gpt-5.4 | openai | 美国网关 | 56 | 3.30s 多维探测 · 延迟 3.30s · 算对 · 推理对 · 多步OK · Arena Agent #16 (net +5.1%) | 探测AAOR | 查看佐证 | |
| 30 | gpt-5.6-luna gpt-5.6-luna | openai | 美国网关 | 56 | 1.62s 多维探测 · 延迟 1.62s · 算对 · 多步弱 · Arena Agent #18 (net +3.5%) | 探测AAOR | 查看佐证 | |
| 31 | gpt-5.6-sol gpt-5.6-sol | openai | 美国网关 | 56 | 43.13s 多维探测 · 延迟 43.13s · 算对 · 推理对 · 多步OK · Arena Agent #4 (net +10.0%) | 探测AAOR | 查看佐证 | |
| 32 | codex-auto-review codex-auto-review | openai | 美国网关 | 54 | 5.84s 多维探测 · 延迟 5.84s · 算对 · 推理对 · 多步OK | 探测 | 查看佐证 | |
| 33 | gpt-5.5 gpt-5.5 | openai | 美国网关 | 54 | 31.02s 多维探测 · 延迟 31.02s · 算对 · 推理对 · 多步OK · Arena Agent #8 (net +8.5%) | 探测AAOR | 查看佐证 | |
| 34 | grok-composer grok-composer | xai | 美国网关 | 46 | 0.80s 探测异常 · HTTP Error 400: Bad Request | 探测 | 查看佐证 | |
| 35 | gpt-5.6-terra gpt-5.6-terra | openai | 美国网关 | 35 | 3.43s 多维探测 · 延迟 3.43s · 算对 · 多步弱 · Arena Agent #17 (net +3.5%) | 探测AAOR | 查看佐证 | |
| 36 | deepseek-v4-pro deepseek-v4-pro | deepseek | 中国网关 | 19 | 3.36s 探测异常 · 输出未通过 · Arena Agent #26 (net +0.8%) | 探测AAOR | 查看佐证 | |
| 37 | gpt-5.2-pro gpt-5.2-pro | openai | 美国网关 | 18 | 5.20s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照OR | 查看佐证 | |
| 38 | gpt-5.2-pro-2025-12-11 gpt-5.2-pro-2025-12-11 | openai | 美国网关 | 18 | 5.24s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照 | 查看佐证 | |
| 39 | gpt-5.2 gpt-5.2 | openai | 美国网关 | 16 | 5.14s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照OR | 查看佐证 | |
| 40 | gpt-5.2-2025-12-11 gpt-5.2-2025-12-11 | openai | 美国网关 | 16 | 6.15s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照 | 查看佐证 | |
| 41 | gpt-5.2-chat-latest gpt-5.2-chat-latest | openai | 美国网关 | 16 | 5.33s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照 | 查看佐证 | |
| 42 | gpt-5.4-2026-03-05 gpt-5.4-2026-03-05 | openai | 美国网关 | 16 | 55.39s 探测异常 · The read operation timed out · Arena Agent #16 (net +5.1%) | 探测OR快照Arena | 查看佐证 | |
| 43 | deepseek-v4-flash deepseek-v4-flash | deepseek | 中国网关 | 14 | 3.44s 探测异常 · 输出未通过 · Arena Agent #34 (net +3.0%) | 探测OR快照OR | 查看佐证 | |
| 44 | gpt-5.3-codex-spark gpt-5.3-codex-spark | openai | 美国网关 | 14 | 5.15s 探测异常 · HTTP Error 502: Bad Gateway | 探测OR快照 | 查看佐证 |
启发式维度(中文/英文/OCR/软件等)在无官方公开 bench 时由厂商归属、模态与关联模型热度估算,仅供选型参考; 客观能力以 AA 智力/代码/Agent 与本站实测为准。交叉验证: 用量榜 · 模型目录 · 实验室。
同系工具:Clavue CLI / imux IDE / clavue-2.1
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗