大模型速度图

这张图把「分数」和「速度」放进同一张图:越靠右输出越快,越靠上越强,越贴近右上角越理想。气泡越大表示输出价越低。

更新于 9月14日 55 个模型 每日同步 3 个待评分 ↓
显示 30 个模型价格单位:美元 / 百万 tokens

评分与速度,一眼看清

速度评分前沿气泡大小=输出价格(越大越便宜) $0.1772–$50.00

如何读图

越靠上评分越高,越靠右输出越快。气泡越大表示输出价越低。选择图标查看详情。

绿线基于全部已评分且有实测速度的模型;筛选不会改变这条参照线。

未测速或未评分的模型不参与本图;缺少报价的模型气泡取下限半径,不代表它便宜。

评分口径与数据来源

Arena 是 LMArena 的综合评分,不是独立编程评测。价格为 OpenRouter 报价;开放权重不等于无限制商用。评分/价格比仅为 Arena 分数除以输出价,不是独立评测指标。 数据来源

图中模型
  1. Claude Fable 5.153.470/s
  2. GPT-6 Astra52.868/s
  3. Claude Opus 550.758/s
  4. Claude Fable 549.770/s
  5. GPT-5.6 Sol47.168/s
  6. GLM-5.344.968/s
  7. Grok 4.644.471/s
  8. Kimi K343.837/s
  9. GPT-5.6 Terra42.3125/s
  10. GLM-5.3 Flash41.9114/s
  11. Gemini 3.8 Flash41.2340/s
  12. Qwen3.8 Max40.343/s
  13. Muse Spark 1.239.8211/s
  14. DeepSeek V4.1 Flash39.5227/s
  15. Gemini 3.7 Flash39.4337/s
  16. Grok 4.539.161/s
  17. Claude Sonnet 538.489/s
  18. GPT-5.6 Luna37.5118/s
  19. DeepSeek V4 Pro36.375/s
  20. DeepSeek V4 Flash34.5226/s
  21. Gemini 3.6 Flash34.3222/s
  22. GLM-5.234.074/s
  23. Gemini 3.1 Pro Preview30.4127/s
  24. MiniMax M329.6118/s
  25. MiMo V2.5 Pro26.442/s
  26. Kimi K2.7 Code26.344/s
  27. Qwen3.7 Plus25.874/s
  28. Hy325.897/s
  29. MiMo V2.522.355/s
  30. Mistral Medium 3.514.9166/s
综合第一 Claude Fable 5.1 Arena 1,507.6 最高评分/价格比 DeepSeek V4 Flash 8,080.1 最高评分开放权重模型 GLM-5.3 Arena 1,475.1 最新上榜 DeepSeek V4.1 Flash 9月10日

尚未进入 Arena 排名

以下 3 个模型已被本站收录,但 LMArena 尚未给出评分,因此不参与上方排名(有名次才叫排名,不造分)。按上架时间倒序;LMArena 收录后会自动进入排行榜。

近 14 天新模型

按上架时间排序,均为已进入排行榜的模型;尚未评分的新模型见「尚未进入 Arena 排名」。

数据来源

本页为非官方镜像,不自造总分;价格为 OpenRouter 平台报价($/1M tokens);Arena 分为 Bradley-Terry 口径,不是 Elo。

常见问题

现在哪个大模型最强?

以本表综合排名为准,接近时再看价格和是否开源,没有单一最强。

开源大模型和闭源有什么区别?

开源权重可本机或私有部署;闭源一般走 API。开源列表见 开源大模型排行榜

写代码该看哪个大模型?

专业代码榜和本表不是同一套题。编程向筛选见 编程大模型排行榜,当前按综合分排序。

现在国产最强的大模型是谁?

没有单一最强。国产开源可看 开源大模型排行榜,接近时再看价格和能否本机部署。

价格为什么和官网不同?

表内是 OpenRouter 美元/百万 token,可能与官方 API 或国内中转不同。