LLM パレート図

一枚のグラフで、モデルのスコアと API 出力価格を確認できます。

更新 9月14日 55 モデル 毎日同期 3 件が採点待ち ↓
54 モデルを表示価格単位:米ドル / 100万トークン

スコアと価格をひと目で確認

0 20 40 60 $0.1 $1.00 $10.00 $100 知能指数 出力価格・米ドル / 100万トークン(対数スケール) A Claude Fable 5.1 · 速度 70/s · 推論段階 47.0–53.4 A Claude Opus 5 · 速度 58/s · 推論段階 39.8–50.7 A Claude Opus 4.6 G Gemini 3.8 Flash · 速度 340/s · 推論段階 33.8–41.2 A Claude Fable 5 · 速度 70/s G Gemini 3.7 Flash · 速度 337/s · 推論段階 36.9–39.6 A Claude Opus 4.7 · 推論段階 30.9–40.7 M Muse Spark 1.2 · 速度 211/s G Gemini 3.5 Flash · 推論段階 33.0–33.6 A Qwen3.8 Max · 速度 43/s M Muse Spark 1.1 G Gemini 3.1 Pro Preview · 速度 127/s G Gemini 3.6 Flash · 速度 222/s Z GLM-5.3 · 速度 68/s A Qwen3.7 Max M Kimi K3 · 速度 37/s · 推論段階 30.5–43.8 Z GLM-5.3 Flash · 速度 114/s O GPT-5.5 · 推論段階 23.2–38.6 O GPT-5.4 · 推論段階 18.2–39.0 Z GLM-5.2 · 速度 74/s · 推論段階 22.4–34.0 G Gemini 3 Flash · 推論段階 17.9–26.3 X MiMo V2.5 Pro · 速度 42/s · 推論段階 18.3–26.4 Z GLM-5.1 · 推論段階 24.2–26.4 A Claude Opus 4.8 A Claude Sonnet 4.6 · 推論段階 24.7–30.5 G Gemini 2.5 Pro O GPT-5.6 Sol · 速度 68/s · 推論段階 28.3–47.1 M Kimi K2.6 · 推論段階 23.6–31.3 A Qwen3.7 Plus · 速度 74/s D DeepSeek V4 Pro · 速度 75/s x Grok 4.5 · 速度 61/s A Qwen3.6 Max Z GLM-5 · 推論段階 21.8–27.9 O GPT-5.6 Terra · 速度 125/s · 推論段階 22.3–42.3 A Claude Sonnet 5 · 速度 89/s · 推論段階 24.7–38.4 T Hy3 · 速度 97/s · 推論段階 17.0–25.8 M MiniMax M3 · 速度 118/s D DeepSeek V4 Flash · 速度 226/s O GPT-5.6 Luna · 速度 118/s · 推論段階 16.8–37.5 x Grok 4.6 · 速度 71/s · 推論段階 35.4–44.4 X MiMo V2.5 · 速度 55/s O GPT-5.2 · 推論段階 17.0–30.4 A Claude Opus 4.5 · 推論段階 23.7–29.1 D DeepSeek V3.2 · 推論段階 16.0–21.5 D DeepSeek V4.1 Flash · 速度 227/s M Mistral Large M Mistral Medium 3.5 · 速度 166/s M Kimi K2.5 · 推論段階 19.4–23.5 M Kimi K2.7 Code · 速度 44/s O GPT-5.1 · 推論段階 13.3–24.7 O GPT-6 Astra · 速度 68/s · 推論段階 46.0–52.8 A Qwen3 Max · 推論段階 15.6–21.3 x Grok 4.20 · 推論段階 14.2–25.7 Z GLM-4.6 · 推論段階 14.9–18.5
価格・スコアのフロンティアバブルの大きさ=出力速度 37–340/s

グラフの見方

上に行くほどスコアが高く、左に行くほど出力価格が安くなります。アイコンを選択して詳細を確認してください。

緑の線は、スコアがあり出力価格が 0 より大きいすべてのモデルに基づきます。フィルターでこの基準線は変わりません。

無料、価格未設定、または未スコアのモデルは対数価格グラフに含まれません。ランキングでご確認ください。

スコア基準とデータソース

Arena は LMArena の総合スコアであり、独立したコーディング評価ではありません。価格は OpenRouter の表示価格です。オープンウェイトは無制限の商用利用を意味しません。スコア/価格比は Arena スコアを出力価格で割った値であり、独立した評価指標ではありません。 データソース

グラフ内のモデル
  1. Claude Fable 5.153.4$50.00
  2. GPT-6 Astra52.8$50.00
  3. Claude Opus 550.7$25.00
  4. Claude Fable 549.7$50.00
  5. GPT-5.6 Sol47.1$10.00
  6. GLM-5.344.9$4.40
  7. Grok 4.644.4$6.00
  8. Kimi K343.8$13.28
  9. GPT-5.6 Terra42.3$12.00
  10. Claude Opus 4.842.0$25.00
  11. GLM-5.3 Flash41.9$0.5
  12. Gemini 3.8 Flash41.2$3.75
  13. Claude Opus 4.740.7$25.00
  14. Qwen3.8 Max40.3$6.00
  15. Muse Spark 1.239.8$4.25
  16. DeepSeek V4.1 Flash39.5$1.20
  17. Gemini 3.7 Flash39.4$3.75
  18. Grok 4.539.1$6.00
  19. GPT-5.439.0$15.00
  20. GPT-5.538.6$30.00
  21. Claude Sonnet 538.4$10.00
  22. GPT-5.6 Luna37.5$1.20
  23. DeepSeek V4 Pro36.3$3.20
  24. DeepSeek V4 Flash34.5$0.1772
  25. Muse Spark 1.134.3$4.25
  26. Gemini 3.6 Flash34.3$3.75
  27. GLM-5.234.0$2.15
  28. Gemini 3.5 Flash33.0$9.00
  29. Claude Opus 4.631.9$25.00
  30. Kimi K2.631.3$4.00
  31. Gemini 3.1 Pro Preview30.4$12.00
  32. GPT-5.230.4$14.00
  33. Qwen3.7 Max29.9$4.43
  34. MiniMax M329.6$1.20
  35. Qwen3.6 Max28.4$6.16
  36. GLM-527.9$1.92
  37. MiMo V2.5 Pro26.4$0.87
  38. GLM-5.126.4$3.04
  39. Kimi K2.7 Code26.3$3.50
  40. Qwen3.7 Plus25.8$1.28
  41. Hy325.8$0.528
  42. Grok 4.2025.7$2.50
  43. Claude Sonnet 4.624.7$15.00
  44. GPT-5.124.7$10.00
  45. Claude Opus 4.523.7$25.00
  46. Kimi K2.523.5$2.25
  47. MiMo V2.522.3$0.28
  48. Gemini 3 Flash17.9$3.00
  49. Gemini 2.5 Pro16.7$10.00
  50. DeepSeek V3.216.0$0.4
  51. Qwen3 Max15.6$3.90
  52. Mistral Medium 3.514.9$7.50
  53. GLM-4.614.9$1.75
  54. Mistral Large5.8$6.00
総合 1 位 Claude Fable 5.1 Arena 1,507.6 最高スコア/価格比 DeepSeek V4 Flash 8,080.1 最高スコアのオープンウェイトモデル GLM-5.3 Arena 1,475.1 新着 DeepSeek V4.1 Flash 9月10日

まだArenaランキングに未掲載

以下の 3 モデルは当サイトに収録済みですが、LMArena が未評価のため上のランキングには含まれません(実スコアのみ掲載、独自採点はしません)。掲載日の新しい順。Arena に掲載されると自動的にランキングに反映されます。

過去 14 日間の新着モデル

掲載日順。いずれもArenaランキング入り済みのモデルです。未評価の新モデルは「まだArenaランキングに未掲載」を参照してください。

データソース

非公式ミラーです。独自スコアは作りません。価格は OpenRouter の報価($/1M トークン)、Arena スコアは Bradley-Terry 方式で Elo ではありません。

よくある質問

今いちばん強い LLM は?

この表の総合ランキングを基準にしてください。スコアが接近している場合は価格とオープンソースかどうかで判断します。

オープンソース LLM とクローズドの違いは?

オープンウェイトは自前・プライベート環境に配置できます。クローズドは通常 API 経由です。一覧は オープンソース LLM リーダーボード

コーディングにはどの LLM を見ればいい?

専門のコーディングベンチマークはこの表と別の問題セットです。コーディング向けの絞り込みは コーディング LLM リーダーボード を参照(現在は総合スコア順)。

今いちばん強い中国製 LLM は?

単一の最強はありません。中国製オープンウェイトは オープンソース LLM リーダーボード を参照し、接近していれば価格と自前配置の可否で判断します。

価格が公式サイトと違うのはなぜ?

この表の価格は OpenRouter のドル/100 万トークン換算で、公式 API や国内中継とは異なる場合があります。