大模型性价比图

同一张图,看清模型评分与 API 输出价格。

更新于 9月14日 55 个模型 每日同步 3 个待评分 ↓
显示 54 个模型价格单位:美元 / 百万 tokens

评分与价格,一眼看清

0 20 40 60 $0.1 $1.00 $10.00 $100 智能指数 输出价 · 美元 / 百万 tokens(对数刻度) A Claude Fable 5.1 · 速度 70/s · 推理档位 47.0–53.4 A Claude Opus 5 · 速度 58/s · 推理档位 39.8–50.7 A Claude Opus 4.6 G Gemini 3.8 Flash · 速度 340/s · 推理档位 33.8–41.2 A Claude Fable 5 · 速度 70/s G Gemini 3.7 Flash · 速度 337/s · 推理档位 36.9–39.6 A Claude Opus 4.7 · 推理档位 30.9–40.7 M Muse Spark 1.2 · 速度 211/s G Gemini 3.5 Flash · 推理档位 33.0–33.6 A Qwen3.8 Max · 速度 43/s M Muse Spark 1.1 G Gemini 3.1 Pro Preview · 速度 127/s G Gemini 3.6 Flash · 速度 222/s Z GLM-5.3 · 速度 68/s A Qwen3.7 Max M Kimi K3 · 速度 37/s · 推理档位 30.5–43.8 Z GLM-5.3 Flash · 速度 114/s O GPT-5.5 · 推理档位 23.2–38.6 O GPT-5.4 · 推理档位 18.2–39.0 Z GLM-5.2 · 速度 74/s · 推理档位 22.4–34.0 G Gemini 3 Flash · 推理档位 17.9–26.3 X MiMo V2.5 Pro · 速度 42/s · 推理档位 18.3–26.4 Z GLM-5.1 · 推理档位 24.2–26.4 A Claude Opus 4.8 A Claude Sonnet 4.6 · 推理档位 24.7–30.5 G Gemini 2.5 Pro O GPT-5.6 Sol · 速度 68/s · 推理档位 28.3–47.1 M Kimi K2.6 · 推理档位 23.6–31.3 A Qwen3.7 Plus · 速度 74/s D DeepSeek V4 Pro · 速度 75/s x Grok 4.5 · 速度 61/s A Qwen3.6 Max Z GLM-5 · 推理档位 21.8–27.9 O GPT-5.6 Terra · 速度 125/s · 推理档位 22.3–42.3 A Claude Sonnet 5 · 速度 89/s · 推理档位 24.7–38.4 T Hy3 · 速度 97/s · 推理档位 17.0–25.8 M MiniMax M3 · 速度 118/s D DeepSeek V4 Flash · 速度 226/s O GPT-5.6 Luna · 速度 118/s · 推理档位 16.8–37.5 x Grok 4.6 · 速度 71/s · 推理档位 35.4–44.4 X MiMo V2.5 · 速度 55/s O GPT-5.2 · 推理档位 17.0–30.4 A Claude Opus 4.5 · 推理档位 23.7–29.1 D DeepSeek V3.2 · 推理档位 16.0–21.5 D DeepSeek V4.1 Flash · 速度 227/s M Mistral Large M Mistral Medium 3.5 · 速度 166/s M Kimi K2.5 · 推理档位 19.4–23.5 M Kimi K2.7 Code · 速度 44/s O GPT-5.1 · 推理档位 13.3–24.7 O GPT-6 Astra · 速度 68/s · 推理档位 46.0–52.8 A Qwen3 Max · 推理档位 15.6–21.3 x Grok 4.20 · 推理档位 14.2–25.7 Z GLM-4.6 · 推理档位 14.9–18.5
价格评分前沿气泡大小=输出速度 37–340/s

如何读图

越靠上评分越高,越靠左输出越便宜。选择图标查看详情。

绿线基于全部已评分且输出价大于零的模型;筛选不会改变这条参照线。

免费、未定价或未评分的模型不参与对数价格图;请在排行榜中查看。

评分口径与数据来源

Arena 是 LMArena 的综合评分,不是独立编程评测。价格为 OpenRouter 报价;开放权重不等于无限制商用。评分/价格比仅为 Arena 分数除以输出价,不是独立评测指标。 数据来源

图中模型
  1. Claude Fable 5.153.4$50.00
  2. GPT-6 Astra52.8$50.00
  3. Claude Opus 550.7$25.00
  4. Claude Fable 549.7$50.00
  5. GPT-5.6 Sol47.1$10.00
  6. GLM-5.344.9$4.40
  7. Grok 4.644.4$6.00
  8. Kimi K343.8$13.28
  9. GPT-5.6 Terra42.3$12.00
  10. Claude Opus 4.842.0$25.00
  11. GLM-5.3 Flash41.9$0.5
  12. Gemini 3.8 Flash41.2$3.75
  13. Claude Opus 4.740.7$25.00
  14. Qwen3.8 Max40.3$6.00
  15. Muse Spark 1.239.8$4.25
  16. DeepSeek V4.1 Flash39.5$1.20
  17. Gemini 3.7 Flash39.4$3.75
  18. Grok 4.539.1$6.00
  19. GPT-5.439.0$15.00
  20. GPT-5.538.6$30.00
  21. Claude Sonnet 538.4$10.00
  22. GPT-5.6 Luna37.5$1.20
  23. DeepSeek V4 Pro36.3$3.20
  24. DeepSeek V4 Flash34.5$0.1772
  25. Muse Spark 1.134.3$4.25
  26. Gemini 3.6 Flash34.3$3.75
  27. GLM-5.234.0$2.15
  28. Gemini 3.5 Flash33.0$9.00
  29. Claude Opus 4.631.9$25.00
  30. Kimi K2.631.3$4.00
  31. Gemini 3.1 Pro Preview30.4$12.00
  32. GPT-5.230.4$14.00
  33. Qwen3.7 Max29.9$4.43
  34. MiniMax M329.6$1.20
  35. Qwen3.6 Max28.4$6.16
  36. GLM-527.9$1.92
  37. MiMo V2.5 Pro26.4$0.87
  38. GLM-5.126.4$3.04
  39. Kimi K2.7 Code26.3$3.50
  40. Qwen3.7 Plus25.8$1.28
  41. Hy325.8$0.528
  42. Grok 4.2025.7$2.50
  43. Claude Sonnet 4.624.7$15.00
  44. GPT-5.124.7$10.00
  45. Claude Opus 4.523.7$25.00
  46. Kimi K2.523.5$2.25
  47. MiMo V2.522.3$0.28
  48. Gemini 3 Flash17.9$3.00
  49. Gemini 2.5 Pro16.7$10.00
  50. DeepSeek V3.216.0$0.4
  51. Qwen3 Max15.6$3.90
  52. Mistral Medium 3.514.9$7.50
  53. GLM-4.614.9$1.75
  54. Mistral Large5.8$6.00
综合第一 Claude Fable 5.1 Arena 1,507.6 最高评分/价格比 DeepSeek V4 Flash 8,080.1 最高评分开放权重模型 GLM-5.3 Arena 1,475.1 最新上榜 DeepSeek V4.1 Flash 9月10日

尚未进入 Arena 排名

以下 3 个模型已被本站收录,但 LMArena 尚未给出评分,因此不参与上方排名(有名次才叫排名,不造分)。按上架时间倒序;LMArena 收录后会自动进入排行榜。

近 14 天新模型

按上架时间排序,均为已进入排行榜的模型;尚未评分的新模型见「尚未进入 Arena 排名」。

数据来源

本页为非官方镜像,不自造总分;价格为 OpenRouter 平台报价($/1M tokens);Arena 分为 Bradley-Terry 口径,不是 Elo。

常见问题

现在哪个大模型最强?

以本表综合排名为准,接近时再看价格和是否开源,没有单一最强。

开源大模型和闭源有什么区别?

开源权重可本机或私有部署;闭源一般走 API。开源列表见 开源大模型排行榜

写代码该看哪个大模型?

专业代码榜和本表不是同一套题。编程向筛选见 编程大模型排行榜,当前按综合分排序。

现在国产最强的大模型是谁?

没有单一最强。国产开源可看 开源大模型排行榜,接近时再看价格和能否本机部署。

价格为什么和官网不同?

表内是 OpenRouter 美元/百万 token,可能与官方 API 或国内中转不同。