OnlySOTA

家族榜:每条产品线以最强模型出战

每个家族(如 Claude Opus、Gemini Flash)由其中最强的一款代表,整行原样取用。

SOTA
13个模型
得分高过斩杀者
第一 · AA
Claude Opus 5.5
57.6 · $8.00
斩杀者 · 价格
Claude Haiku 5.5
$0.20
最便宜的 SOTA
MiMo V2.6 Pro
46.3 · $0.54
排行 · AA 28–58 · ARENA 1416–1534
  1. 1成绩来自 Claude Opus 5.557.61507
  2. 2成绩来自 GPT 6 Astra52.71475
  3. 352.61525
  4. 448.11494
  5. 5成绩来自 Grok 4.746.41443
  6. 646.31480
  7. 745.41483
  8. 844.81478
  9. 943.71447
  10. 1043.61488
  11. 11新上榜斩杀者43.4—
查看 AA 的全部 375 个模型 →
斩杀线:得分 × 价格

斩杀者是全场性价比最高的模型:比它贵、得分又不更高的,都被它斩杀。 斩杀线是怎么画的 →历任斩杀者 →

Artificial Analysis Intelligence Index · 刻度从 0 开始2040600$0.05$0.25$1.00$5.00$20.0057.6$8.00Claude Opus 5.5斩杀者Claude Haiku 5.543.4 · $0.20SOTA低成本被斩杀Blended Price, USD per 1M tokens (3:1 input:output) · log10
斩杀线前沿线:没有哪个模型在价格和得分上同时胜过它们SOTA低成本被斩杀空心点或浅色叉:该榜的估算值

Claude Opus 5.5

anthropic/claude-opus-5-5 · 闭源 · $8.00 · SOTA

查看完整页面 →
各榜成绩
  • Artificial Analysis LLM Leaderboard57.6第 1 名,共 375 个
  • Arena — Agent0.143第 1 名,共 52 个
  • Artificial Analysis Coding Agents0.660第 2 名,共 24 个
  • Epoch AI Benchmarking Hub91.2%第 3 名,共 82 个
  • Terminal-Bench 4.064.8%第 1 名,共 35 个
  • Arena — Code1813第 1 名,共 142 个
  • Arena — Text1507第 2 名,共 414 个
  • Arena — Vision1293第 11 名,共 165 个
不同推理强度下的成绩

Artificial Analysis LLM Leaderboardmax 最高

  1. low42.3
  2. medium51.2
  3. high53.6
  4. xhigh56.0
  5. max57.6

只测了一档

  • Arena — Agent · agenthigh0.143
  • Artificial Analysis Coding Agents · Claude Codemax0.660
  • Epoch AI Benchmarking Hubmax91.2%
  • Terminal-Bench 4.0 · Claude Codemax64.8%
  • Arena — Codemax1813
  • Arena — Texthigh1507
  • Arena — Visionhigh1293