大模型性價比圖

同一張圖,看清模型評分與 API 輸出價格。

更新於 9月14日 55 個模型 每日同步 3 個待評分 ↓
顯示 54 個模型價格單位:美元 / 百萬 tokens

評分與價格,一眼看清

0 20 40 60 $0.1 $1.00 $10.00 $100 智慧指數 輸出價 · 美元 / 百萬 tokens(對數刻度) A Claude Fable 5.1 · 速度 70/s · 推理檔位 47.0–53.4 A Claude Opus 5 · 速度 58/s · 推理檔位 39.8–50.7 A Claude Opus 4.6 G Gemini 3.8 Flash · 速度 340/s · 推理檔位 33.8–41.2 A Claude Fable 5 · 速度 70/s G Gemini 3.7 Flash · 速度 337/s · 推理檔位 36.9–39.6 A Claude Opus 4.7 · 推理檔位 30.9–40.7 M Muse Spark 1.2 · 速度 211/s G Gemini 3.5 Flash · 推理檔位 33.0–33.6 A Qwen3.8 Max · 速度 43/s M Muse Spark 1.1 G Gemini 3.1 Pro Preview · 速度 127/s G Gemini 3.6 Flash · 速度 222/s Z GLM-5.3 · 速度 68/s A Qwen3.7 Max M Kimi K3 · 速度 37/s · 推理檔位 30.5–43.8 Z GLM-5.3 Flash · 速度 114/s O GPT-5.5 · 推理檔位 23.2–38.6 O GPT-5.4 · 推理檔位 18.2–39.0 Z GLM-5.2 · 速度 74/s · 推理檔位 22.4–34.0 G Gemini 3 Flash · 推理檔位 17.9–26.3 X MiMo V2.5 Pro · 速度 42/s · 推理檔位 18.3–26.4 Z GLM-5.1 · 推理檔位 24.2–26.4 A Claude Opus 4.8 A Claude Sonnet 4.6 · 推理檔位 24.7–30.5 G Gemini 2.5 Pro O GPT-5.6 Sol · 速度 68/s · 推理檔位 28.3–47.1 M Kimi K2.6 · 推理檔位 23.6–31.3 A Qwen3.7 Plus · 速度 74/s D DeepSeek V4 Pro · 速度 75/s x Grok 4.5 · 速度 61/s A Qwen3.6 Max Z GLM-5 · 推理檔位 21.8–27.9 O GPT-5.6 Terra · 速度 125/s · 推理檔位 22.3–42.3 A Claude Sonnet 5 · 速度 89/s · 推理檔位 24.7–38.4 T Hy3 · 速度 97/s · 推理檔位 17.0–25.8 M MiniMax M3 · 速度 118/s D DeepSeek V4 Flash · 速度 226/s O GPT-5.6 Luna · 速度 118/s · 推理檔位 16.8–37.5 x Grok 4.6 · 速度 71/s · 推理檔位 35.4–44.4 X MiMo V2.5 · 速度 55/s O GPT-5.2 · 推理檔位 17.0–30.4 A Claude Opus 4.5 · 推理檔位 23.7–29.1 D DeepSeek V3.2 · 推理檔位 16.0–21.5 D DeepSeek V4.1 Flash · 速度 227/s M Mistral Large M Mistral Medium 3.5 · 速度 166/s M Kimi K2.5 · 推理檔位 19.4–23.5 M Kimi K2.7 Code · 速度 44/s O GPT-5.1 · 推理檔位 13.3–24.7 O GPT-6 Astra · 速度 68/s · 推理檔位 46.0–52.8 A Qwen3 Max · 推理檔位 15.6–21.3 x Grok 4.20 · 推理檔位 14.2–25.7 Z GLM-4.6 · 推理檔位 14.9–18.5
價格評分前沿氣泡大小=輸出速度 37–340/s

如何讀圖

越靠上評分越高,越靠左輸出越便宜。選擇圖示查看詳情。

綠線基於全部已有評分且輸出價大於零的模型;篩選不會改變這條參照線。

免費、未定價或未評分的模型不參與對數價格圖;請在排行榜中查看。

評分口徑與資料來源

Arena 是 LMArena 的綜合評分,不是獨立程式評測。價格為 OpenRouter 報價;開放權重不等於可不受限制地商用。評分/價格比僅為 Arena 分數除以輸出價,不是獨立評測指標。 數據來源

圖中模型
  1. Claude Fable 5.153.4$50.00
  2. GPT-6 Astra52.8$50.00
  3. Claude Opus 550.7$25.00
  4. Claude Fable 549.7$50.00
  5. GPT-5.6 Sol47.1$10.00
  6. GLM-5.344.9$4.40
  7. Grok 4.644.4$6.00
  8. Kimi K343.8$13.28
  9. GPT-5.6 Terra42.3$12.00
  10. Claude Opus 4.842.0$25.00
  11. GLM-5.3 Flash41.9$0.5
  12. Gemini 3.8 Flash41.2$3.75
  13. Claude Opus 4.740.7$25.00
  14. Qwen3.8 Max40.3$6.00
  15. Muse Spark 1.239.8$4.25
  16. DeepSeek V4.1 Flash39.5$1.20
  17. Gemini 3.7 Flash39.4$3.75
  18. Grok 4.539.1$6.00
  19. GPT-5.439.0$15.00
  20. GPT-5.538.6$30.00
  21. Claude Sonnet 538.4$10.00
  22. GPT-5.6 Luna37.5$1.20
  23. DeepSeek V4 Pro36.3$3.20
  24. DeepSeek V4 Flash34.5$0.1772
  25. Muse Spark 1.134.3$4.25
  26. Gemini 3.6 Flash34.3$3.75
  27. GLM-5.234.0$2.15
  28. Gemini 3.5 Flash33.0$9.00
  29. Claude Opus 4.631.9$25.00
  30. Kimi K2.631.3$4.00
  31. Gemini 3.1 Pro Preview30.4$12.00
  32. GPT-5.230.4$14.00
  33. Qwen3.7 Max29.9$4.43
  34. MiniMax M329.6$1.20
  35. Qwen3.6 Max28.4$6.16
  36. GLM-527.9$1.92
  37. MiMo V2.5 Pro26.4$0.87
  38. GLM-5.126.4$3.04
  39. Kimi K2.7 Code26.3$3.50
  40. Qwen3.7 Plus25.8$1.28
  41. Hy325.8$0.528
  42. Grok 4.2025.7$2.50
  43. Claude Sonnet 4.624.7$15.00
  44. GPT-5.124.7$10.00
  45. Claude Opus 4.523.7$25.00
  46. Kimi K2.523.5$2.25
  47. MiMo V2.522.3$0.28
  48. Gemini 3 Flash17.9$3.00
  49. Gemini 2.5 Pro16.7$10.00
  50. DeepSeek V3.216.0$0.4
  51. Qwen3 Max15.6$3.90
  52. Mistral Medium 3.514.9$7.50
  53. GLM-4.614.9$1.75
  54. Mistral Large5.8$6.00
綜合第一 Claude Fable 5.1 Arena 1,507.6 最高評分/價格比 DeepSeek V4 Flash 8,080.1 最高評分開放權重模型 GLM-5.3 Arena 1,475.1 最新上榜 DeepSeek V4.1 Flash 9月10日

尚未進入 Arena 排名

以下 3 個模型已被本站收錄,但 LMArena 尚未給出評分,因此不參與上方排名(有名次才叫排名,不造分)。按上架時間倒序;LMArena 收錄後會自動進入排行榜。

近 14 天新模型

按上架時間排序,均為已進入排行榜的模型;尚未評分的新模型見「尚未進入 Arena 排名」。

數據來源

本頁為非官方鏡像,不自造總分;價格為 OpenRouter 平台報價($/1M tokens);Arena 分為 Bradley-Terry 口徑,不是 Elo。

常見問題

現在哪個大模型最強?

以本表綜合排名為準,接近時再看價格和是否開源,沒有單一最強。

開源大模型和閉源有什麼區別?

開源權重可本機或私有部署;閉源一般走 API。開源列表見 開源大模型排行榜

寫程式碼該看哪個大模型?

專業程式碼榜和本表不是同一套題。程式向篩選見 程式大模型排行榜,當前按綜合分排序。

現在國產最強的大模型是誰?

沒有單一最強。國產開源可看 開源大模型排行榜,接近時再看價格和能否本機部署。

價格為什麼和官網不同?

表內是 OpenRouter 美元/百萬 token,可能與官方 API 或國內中轉不同。