OnlySOTA

家族榜:每條產品線以最強模型出戰

每個家族(如 Claude Opus、Gemini Flash)由其中最強的一款代表,整行原樣取用。

SOTA
13個模型
得分高過斬殺者
第一 · AA
Claude Opus 5.5
57.6 · $8.00
斬殺者 · 價格
Claude Haiku 5.5
$0.20
最便宜的 SOTA
MiMo V2.6 Pro
46.3 · $0.54
排行 · AA 28–58 · ARENA 1416–1534
  1. 1成績來自 Claude Opus 5.557.61507
  2. 2成績來自 GPT 6 Astra52.71475
  3. 352.61525
  4. 448.11494
  5. 5成績來自 Grok 4.746.41443
  6. 646.31480
  7. 745.41483
  8. 844.81478
  9. 943.71447
  10. 1043.61488
  11. 11新上榜斬殺者43.4—
檢視 AA 的全部 375 個模型 →
斬殺線:得分 × 價格

斬殺者是全場性價比最高的模型:比它貴、得分又不更高的,都被它斬殺。 斬殺線是怎麼畫的 →歷任斬殺者 →

Artificial Analysis Intelligence Index · 刻度從 0 開始2040600$0.05$0.25$1.00$5.00$20.0057.6$8.00Claude Opus 5.5斬殺者Claude Haiku 5.543.4 · $0.20SOTA低成本被斬殺Blended Price, USD per 1M tokens (3:1 input:output) · log10
斬殺線前沿線:沒有哪個模型在價格和得分上同時勝過它們SOTA低成本被斬殺空心點或淺色叉:該榜的估算值

Claude Opus 5.5

anthropic/claude-opus-5-5 · 閉源 · $8.00 · SOTA

檢視完整頁面 →
各榜成績
  • Artificial Analysis LLM Leaderboard57.6第 1 名,共 375 個
  • Arena — Agent0.143第 1 名,共 52 個
  • Artificial Analysis Coding Agents0.660第 2 名,共 24 個
  • Epoch AI Benchmarking Hub91.2%第 3 名,共 82 個
  • Terminal-Bench 4.064.8%第 1 名,共 35 個
  • Arena — Code1813第 1 名,共 142 個
  • Arena — Text1507第 2 名,共 414 個
  • Arena — Vision1293第 11 名,共 165 個
不同推理強度下的成績

Artificial Analysis LLM Leaderboardmax 最高

  1. low42.3
  2. medium51.2
  3. high53.6
  4. xhigh56.0
  5. max57.6

只測了一檔

  • Arena — Agent · agenthigh0.143
  • Artificial Analysis Coding Agents · Claude Codemax0.660
  • Epoch AI Benchmarking Hubmax91.2%
  • Terminal-Bench 4.0 · Claude Codemax64.8%
  • Arena — Codemax1813
  • Arena — Texthigh1507
  • Arena — Visionhigh1293