OnlySOTA

廠商榜:各家以最強模型出戰

每家公司由旗下最強的一款模型代表,整行原樣取用。

SOTA
13個模型
得分高過斬殺者
第一 · AA
Claude Opus 5.5
57.6 · $8.00
斬殺者 · 價格
Claude Haiku 5.5
$0.20
最便宜的 SOTA
MiMo V2.6 Pro
46.3 · $0.54
排行 · AA 28–58 · ARENA 1416–1534
  1. 1成績來自 Claude Opus 5.557.61507
  2. 2成績來自 GPT 6 Astra52.71475
  3. 3成績來自 Gemini 4 Argon52.61525
  4. 4成績來自 Muse Spark 1.348.11494
  5. 5成績來自 Grok 4.746.41443
  6. 6成績來自 MiMo V2.6 Pro46.31480
  7. 7成績來自 Qwen 3.8 Max45.41483
  8. 8成績來自 GLM 5.344.81478
  9. 9成績來自 Step 543.71447
  10. 1043.61488
  11. 11新上榜斬殺者43.4—
檢視 AA 的全部 375 個模型 →
斬殺線:得分 × 價格

斬殺者是全場性價比最高的模型:比它貴、得分又不更高的,都被它斬殺。 斬殺線是怎麼畫的 →歷任斬殺者 →

Artificial Analysis Intelligence Index · 刻度從 0 開始2040600$0.05$0.25$1.00$5.00$20.0057.6$8.00Claude Opus 5.5斬殺者Claude Haiku 5.543.4 · $0.20SOTA低成本被斬殺Blended Price, USD per 1M tokens (3:1 input:output) · log10
斬殺線前沿線:沒有哪個模型在價格和得分上同時勝過它們SOTA低成本被斬殺空心點或淺色叉:該榜的估算值

Claude Opus 5.5

anthropic/claude-opus-5-5 · 閉源 · $8.00 · SOTA

檢視完整頁面 →
各榜成績
  • Artificial Analysis LLM Leaderboard57.6第 1 名,共 375 個
  • Arena — Agent0.143第 1 名,共 52 個
  • Artificial Analysis Coding Agents0.660第 2 名,共 24 個
  • Epoch AI Benchmarking Hub91.2%第 3 名,共 82 個
  • Terminal-Bench 4.064.8%第 1 名,共 35 個
  • Arena — Code1813第 1 名,共 142 個
  • Arena — Text1507第 2 名,共 414 個
  • Arena — Vision1293第 11 名,共 165 個
不同推理強度下的成績

Artificial Analysis LLM Leaderboardmax 最高

  1. low42.3
  2. medium51.2
  3. high53.6
  4. xhigh56.0
  5. max57.6

只測了一檔

  • Arena — Agent · agenthigh0.143
  • Artificial Analysis Coding Agents · Claude Codemax0.660
  • Epoch AI Benchmarking Hubmax91.2%
  • Terminal-Bench 4.0 · Claude Codemax64.8%
  • Arena — Codemax1813
  • Arena — Texthigh1507
  • Arena — Visionhigh1293

全部廠商