OnlySOTA

厂商榜:各家以最强模型出战

每家公司由旗下最强的一款模型代表,整行原样取用。

SOTA
13个模型
得分高过斩杀者
第一 · AA
Claude Opus 5.5
57.6 · $8.00
斩杀者 · 价格
Claude Haiku 5.5
$0.20
最便宜的 SOTA
MiMo V2.6 Pro
46.3 · $0.54
排行 · AA 28–58 · ARENA 1416–1534
  1. 1成绩来自 Claude Opus 5.557.61507
  2. 2成绩来自 GPT 6 Astra52.71475
  3. 3成绩来自 Gemini 4 Argon52.61525
  4. 4成绩来自 Muse Spark 1.348.11494
  5. 5成绩来自 Grok 4.746.41443
  6. 6成绩来自 MiMo V2.6 Pro46.31480
  7. 7成绩来自 Qwen 3.8 Max45.41483
  8. 8成绩来自 GLM 5.344.81478
  9. 9成绩来自 Step 543.71447
  10. 1043.61488
  11. 11新上榜斩杀者43.4—
查看 AA 的全部 375 个模型 →
斩杀线:得分 × 价格

斩杀者是全场性价比最高的模型:比它贵、得分又不更高的,都被它斩杀。 斩杀线是怎么画的 →历任斩杀者 →

Artificial Analysis Intelligence Index · 刻度从 0 开始2040600$0.05$0.25$1.00$5.00$20.0057.6$8.00Claude Opus 5.5斩杀者Claude Haiku 5.543.4 · $0.20SOTA低成本被斩杀Blended Price, USD per 1M tokens (3:1 input:output) · log10
斩杀线前沿线:没有哪个模型在价格和得分上同时胜过它们SOTA低成本被斩杀空心点或浅色叉:该榜的估算值

Claude Opus 5.5

anthropic/claude-opus-5-5 · 闭源 · $8.00 · SOTA

查看完整页面 →
各榜成绩
  • Artificial Analysis LLM Leaderboard57.6第 1 名,共 375 个
  • Arena — Agent0.143第 1 名,共 52 个
  • Artificial Analysis Coding Agents0.660第 2 名,共 24 个
  • Epoch AI Benchmarking Hub91.2%第 3 名,共 82 个
  • Terminal-Bench 4.064.8%第 1 名,共 35 个
  • Arena — Code1813第 1 名,共 142 个
  • Arena — Text1507第 2 名,共 414 个
  • Arena — Vision1293第 11 名,共 165 个
不同推理强度下的成绩

Artificial Analysis LLM Leaderboardmax 最高

  1. low42.3
  2. medium51.2
  3. high53.6
  4. xhigh56.0
  5. max57.6

只测了一档

  • Arena — Agent · agenthigh0.143
  • Artificial Analysis Coding Agents · Claude Codemax0.660
  • Epoch AI Benchmarking Hubmax91.2%
  • Terminal-Bench 4.0 · Claude Codemax64.8%
  • Arena — Codemax1813
  • Arena — Texthigh1507
  • Arena — Visionhigh1293

全部厂商