评分佐证 · 全球大模型

Claude Opus 4.8 (Thinking)全球大模型能力

Claude Opus 4.8 (Thinking) 综合智能 69(智力40%+数学30%+代码30%)

综合分
69
模型 IDarena/claude-opus-4.8-thinking
厂商 / 家族Anthropic · anthropic

评分方法论

全量可评分模型 · 综合智能序。

佐证数据源

综合权重 · 代码主依据
74 × 30%
综合权重 · 数学主依据
65 × 30%
综合权重 · 智力主依据
68 × 40%
AA 智力(OR 快照)参考
55.7

OpenRouter benchmarks.artificial_analysis

AA 代码指数参考
74.3
AA Agent 指数参考
80

边界与声明

  • 综合分缺维时对可用维重归一。
  • 佐证生成于页面渲染时 · bench_v1 · AA 2026-07-31 snapshot

相关能力维度

claude-opus-4.8-thinking 的全球大模型能力 · 评分佐证 · GrokCode 倍率榜