评分佐证 · 综合智能

Claude Opus 4.8 (Thinking)综合智能能力

Claude Opus 4.8 (Thinking) 综合智能 69(智力40%+数学30%+代码30%)

综合分
69
模型 IDarena/claude-opus-4.8-thinking
厂商 / 家族Anthropic · anthropic

评分方法论

默认榜:智力 40% + 数学/科学推理 30% + 代码开发 30%。对齐 AA 客观能力 + 本站补全。

佐证数据源

综合权重 · 代码主依据
74 × 30%
综合权重 · 数学主依据
65 × 30%
综合权重 · 智力主依据
68 × 40%
AA 智力(OR 快照)参考
55.7

OpenRouter benchmarks.artificial_analysis

AA 代码指数参考
74.3
AA Agent 指数参考
80

边界与声明

  • 综合分缺维时对可用维重归一。
  • 佐证生成于页面渲染时 · bench_v1 · AA 2026-07-31 snapshot

相关能力维度

claude-opus-4.8-thinking 的综合智能能力 · 评分佐证 · GrokCode 倍率榜