LLM 파레토 차트

하나의 차트에서 모델 점수와 API 출력 가격을 확인하세요.

갱신 9月14日 55 모델 매일 동기화 3 개 평가 대기 ↓
54개 모델 표시가격 단위: USD / 백만 토큰

점수와 가격을 한눈에 확인

0 20 40 60 $0.1 $1.00 $10.00 $100 지능 지수 출력 가격 · USD / 백만 토큰(로그 스케일) A Claude Fable 5.1 · 속도 70/s · 추론 단계 47.0–53.4 A Claude Opus 5 · 속도 58/s · 추론 단계 39.8–50.7 A Claude Opus 4.6 G Gemini 3.8 Flash · 속도 340/s · 추론 단계 33.8–41.2 A Claude Fable 5 · 속도 70/s G Gemini 3.7 Flash · 속도 337/s · 추론 단계 36.9–39.6 A Claude Opus 4.7 · 추론 단계 30.9–40.7 M Muse Spark 1.2 · 속도 211/s G Gemini 3.5 Flash · 추론 단계 33.0–33.6 A Qwen3.8 Max · 속도 43/s M Muse Spark 1.1 G Gemini 3.1 Pro Preview · 속도 127/s G Gemini 3.6 Flash · 속도 222/s Z GLM-5.3 · 속도 68/s A Qwen3.7 Max M Kimi K3 · 속도 37/s · 추론 단계 30.5–43.8 Z GLM-5.3 Flash · 속도 114/s O GPT-5.5 · 추론 단계 23.2–38.6 O GPT-5.4 · 추론 단계 18.2–39.0 Z GLM-5.2 · 속도 74/s · 추론 단계 22.4–34.0 G Gemini 3 Flash · 추론 단계 17.9–26.3 X MiMo V2.5 Pro · 속도 42/s · 추론 단계 18.3–26.4 Z GLM-5.1 · 추론 단계 24.2–26.4 A Claude Opus 4.8 A Claude Sonnet 4.6 · 추론 단계 24.7–30.5 G Gemini 2.5 Pro O GPT-5.6 Sol · 속도 68/s · 추론 단계 28.3–47.1 M Kimi K2.6 · 추론 단계 23.6–31.3 A Qwen3.7 Plus · 속도 74/s D DeepSeek V4 Pro · 속도 75/s x Grok 4.5 · 속도 61/s A Qwen3.6 Max Z GLM-5 · 추론 단계 21.8–27.9 O GPT-5.6 Terra · 속도 125/s · 추론 단계 22.3–42.3 A Claude Sonnet 5 · 속도 89/s · 추론 단계 24.7–38.4 T Hy3 · 속도 97/s · 추론 단계 17.0–25.8 M MiniMax M3 · 속도 118/s D DeepSeek V4 Flash · 속도 226/s O GPT-5.6 Luna · 속도 118/s · 추론 단계 16.8–37.5 x Grok 4.6 · 속도 71/s · 추론 단계 35.4–44.4 X MiMo V2.5 · 속도 55/s O GPT-5.2 · 추론 단계 17.0–30.4 A Claude Opus 4.5 · 추론 단계 23.7–29.1 D DeepSeek V3.2 · 추론 단계 16.0–21.5 D DeepSeek V4.1 Flash · 속도 227/s M Mistral Large M Mistral Medium 3.5 · 속도 166/s M Kimi K2.5 · 추론 단계 19.4–23.5 M Kimi K2.7 Code · 속도 44/s O GPT-5.1 · 추론 단계 13.3–24.7 O GPT-6 Astra · 속도 68/s · 추론 단계 46.0–52.8 A Qwen3 Max · 추론 단계 15.6–21.3 x Grok 4.20 · 추론 단계 14.2–25.7 Z GLM-4.6 · 추론 단계 14.9–18.5
가격-점수 프론티어버블 크기=출력 속도 37–340/s

차트 읽는 방법

위로 갈수록 점수가 높고, 왼쪽으로 갈수록 출력 가격이 저렴합니다. 아이콘을 선택해 상세 정보를 확인하세요.

녹색 선은 점수가 있고 출력 가격이 0보다 큰 모든 모델을 기준으로 합니다. 필터를 적용해도 이 기준선은 바뀌지 않습니다.

무료, 미정가 또는 미평가 모델은 로그 가격 차트에서 제외됩니다. 순위표에서 확인하세요.

점수 기준 및 데이터 출처

Arena는 LMArena의 종합 점수이며 독립적인 코딩 평가가 아닙니다. 가격은 OpenRouter 기준이며, 오픈 웨이트가 무제한 상업 이용을 뜻하지는 않습니다. 점수/가격 비율은 Arena 점수를 출력 가격으로 나눈 값일 뿐 독립적인 평가 지표가 아닙니다. 데이터 출처

차트의 모델
  1. Claude Fable 5.153.4$50.00
  2. GPT-6 Astra52.8$50.00
  3. Claude Opus 550.7$25.00
  4. Claude Fable 549.7$50.00
  5. GPT-5.6 Sol47.1$10.00
  6. GLM-5.344.9$4.40
  7. Grok 4.644.4$6.00
  8. Kimi K343.8$13.28
  9. GPT-5.6 Terra42.3$12.00
  10. Claude Opus 4.842.0$25.00
  11. GLM-5.3 Flash41.9$0.5
  12. Gemini 3.8 Flash41.2$3.75
  13. Claude Opus 4.740.7$25.00
  14. Qwen3.8 Max40.3$6.00
  15. Muse Spark 1.239.8$4.25
  16. DeepSeek V4.1 Flash39.5$1.20
  17. Gemini 3.7 Flash39.4$3.75
  18. Grok 4.539.1$6.00
  19. GPT-5.439.0$15.00
  20. GPT-5.538.6$30.00
  21. Claude Sonnet 538.4$10.00
  22. GPT-5.6 Luna37.5$1.20
  23. DeepSeek V4 Pro36.3$3.20
  24. DeepSeek V4 Flash34.5$0.1772
  25. Muse Spark 1.134.3$4.25
  26. Gemini 3.6 Flash34.3$3.75
  27. GLM-5.234.0$2.15
  28. Gemini 3.5 Flash33.0$9.00
  29. Claude Opus 4.631.9$25.00
  30. Kimi K2.631.3$4.00
  31. Gemini 3.1 Pro Preview30.4$12.00
  32. GPT-5.230.4$14.00
  33. Qwen3.7 Max29.9$4.43
  34. MiniMax M329.6$1.20
  35. Qwen3.6 Max28.4$6.16
  36. GLM-527.9$1.92
  37. MiMo V2.5 Pro26.4$0.87
  38. GLM-5.126.4$3.04
  39. Kimi K2.7 Code26.3$3.50
  40. Qwen3.7 Plus25.8$1.28
  41. Hy325.8$0.528
  42. Grok 4.2025.7$2.50
  43. Claude Sonnet 4.624.7$15.00
  44. GPT-5.124.7$10.00
  45. Claude Opus 4.523.7$25.00
  46. Kimi K2.523.5$2.25
  47. MiMo V2.522.3$0.28
  48. Gemini 3 Flash17.9$3.00
  49. Gemini 2.5 Pro16.7$10.00
  50. DeepSeek V3.216.0$0.4
  51. Qwen3 Max15.6$3.90
  52. Mistral Medium 3.514.9$7.50
  53. GLM-4.614.9$1.75
  54. Mistral Large5.8$6.00
종합 1위 Claude Fable 5.1 Arena 1,507.6 최고 점수/가격 비율 DeepSeek V4 Flash 8,080.1 최고 점수 오픈 웨이트 모델 GLM-5.3 Arena 1,475.1 최신 등재 DeepSeek V4.1 Flash 9月10日

아직 Arena 순위 없음

아래 3개 모델은 본 사이트에 수록되어 있지만 LMArena 아직 평가가 없어 위 순위에는 포함되지 않습니다(실제 점수만 표기, 자체 채점 없음). 등록일 최신순이며 Arena 등재 시 자동으로 순위에 반영됩니다.

최근 14일 신규 모델

등록일 순이며 모두 Arena 순위에 진입한 모델입니다. 미평가 신규 모델은 “아직 Arena 순위 없음” 섹션을 참고하세요.

데이터 출처

비공식 미러이며 자체 점수는 만들지 않습니다. 가격은 OpenRouter 기준($/1M 토큰), Arena 점수는 Bradley-Terry 방식으로 Elo가 아닙니다.

자주 묻는 질문

지금 가장 강한 LLM은?

이 표의 종합 순위를 기준으로 하세요. 점수가 비슷하면 가격과 오픈소스 여부로 판단합니다.

오픈소스 LLM과 클로즈드의 차이는?

오픈 웨이트는 자체·사설 배포가 가능하고, 클로즈드는 보통 API로 이용합니다. 목록은 오픈소스 LLM 리더보드.

코딩에는 어떤 LLM을 봐야 하나요?

전문 코딩 벤치마크는 이 표와 다른 문제 세트입니다. 코딩 필터는 코딩 LLM 리더보드를 참고하세요(현재 종합 점수순).

지금 가장 강한 중국산 LLM은?

단일 최강은 없습니다. 중국산 오픈 웨이트는 오픈소스 LLM 리더보드를 보고, 점수가 비슷하면 가격과 자체 배포 가능 여부로 판단하세요.

가격이 공식 사이트와 다른 이유는?

이 표의 가격은 OpenRouter 기준 USD/백만 토큰으로, 공식 API나 국내 중개와 다를 수 있습니다.