LLM 모델 순위
모델52건Aixploria와 동일하게 Artificial Analysis LLM Leaderboard(Current) 지표를 씁니다. 가격은 $/1M 토큰이 아니라 Cost per Task(작업당 USD)이며, 속도는 Median tok/s, 지연은 First Chunk입니다. 실시간 임베드가 아닌 수동 스냅샷입니다.
시드 52개 · 정렬: 지능순 · 가격 = Cost per Task($) · 속도 = Median tok/s · 출처 AA Leaderboard
| # | 모델 | 카테고리 | 지능 | 가격 | 속도 | 지연 | 컨텍스트 | 링크 |
|---|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5.5 (max) Anthropic · AA Intelligence Index 상위 Anthropic 플래그십. | 대화 | 58 | $5.98 | 92 tok/s | 703s | 1M | |
| 2 | Claude Sonnet 5.5 (max) Anthropic · 품질·속도 균형의 Anthropic 주력 변형. | 대화 | 56 | $7.62 | 139 tok/s | 442s | 1M | |
| 3 | Claude Fable 5.1 (max) Anthropic · AA에 등재된 Anthropic Fable 계열. | 대화 | 53 | $7.63 | 69 tok/s | 269s | 1M | |
| 4 | Gemini 4 Argon (high) Google · Google Gemini 상위 티어(AA 표기). | 멀티모달 | 53 | $1.99 | — | — | 1M | |
| 5 | GPT-6 Astra (max) OpenAI · OpenAI 고난도 추론 계열(AA 표기). | 추론 | 53 | $3.26 | 51 tok/s | 320s | 1M | |
| 6 | GPT-6.1 Sol (max) OpenAI · OpenAI Sol 계열 고지능·상대적 저비용. | 추론 | 52 | $0.72 | 65 tok/s | 282s | 1M | |
| 7 | GPT-6 Sol (max) OpenAI · OpenAI Sol 계열. | 추론 | 48 | $1.04 | 74 tok/s | 179s | 872k | |
| 8 | Muse Spark 1.3 (max) Meta · Meta 계열 고속·고지능 모델(AA 표기). | 오픈 가중치 | 48 | $1.60 | 181 tok/s | 37.3s | 1M | |
| 9 | Grok 4.7 (xhigh) xAI · xAI Grok 고성능 변형. | 대화 | 46 | $3.74 | 73 tok/s | 78.7s | 500k | |
| 10 | MiMo-V2.6-Pro Xiaomi · 저비용·고지능 Xiaomi 모델. | 대화 | 46 | $0.13 | 42 tok/s | 4.20s | 1M | |
| 11 | GLM-5.3 (max) Zhipu AI · Zhipu(Z AI) GLM 상위 티어. | 대화 | 45 | $2.01 | 68 tok/s | 3.25s | 1M | |
| 12 | Qwen3.8 Max (0902) Alibaba · Alibaba Qwen 최상위 상용/오픈 계열. | 오픈 가중치 | 45 | $5.41 | 39 tok/s | 2.98s | 984k | |
| 13 | Kimi K3 (max) Moonshot AI · 초장문 컨텍스트 Kimi 계열. | 대화 | 44 | $2.00 | 34 tok/s | 4.53s | 1.05M | |
| 14 | Step 5 Preview StepFun · StepFun 고지능 프리뷰. | 대화 | 44 | $0.72 | 86 tok/s | 3.12s | 1M | |
| 15 | GLM-5.3-Flash Zhipu AI · GLM 고속·저비용 티어. | 대화 | 42 | $0.25 | 45 tok/s | 3.31s | 1M | |
| 16 | GPT-5.6 Terra (max) OpenAI · OpenAI Terra 계열. | 대화 | 42 | $1.40 | 93 tok/s | 174s | 1M | |
| 17 | Gemini 3.8 Flash (high) Google · Gemini Flash 고속 변형. | 멀티모달 | 41 | $1.24 | 236 tok/s | 21.8s | 1M | |
| 18 | Qwen3.8 2.4T A95B Alibaba · Qwen MoE 초대형. | 오픈 가중치 | 40 | $2.16 | 40 tok/s | 2.90s | 262k | |
| 19 | Qwen3.8-Flash-Next Alibaba · Qwen Flash 저비용 티어. | 오픈 가중치 | 40 | $0.37 | 58 tok/s | 2.50s | 256k | |
| 20 | DeepSeek V4.1 Flash (max) DeepSeek · DeepSeek 고속·저지연 Flash. | 오픈 가중치 | 39 | $0.27 | 209 tok/s | 0.95s | 1M | |
| 21 | GPT-6 Luna (max) OpenAI · OpenAI Luna 초저비용 티어. | 대화 | 38 | $0.07 | 127 tok/s | 124s | 1M | |
| 22 | MiMo-V2.6-Flash Xiaomi · Xiaomi Flash 저비용. | 대화 | 38 | $0.06 | 54 tok/s | 3.91s | 1M | |
| 23 | DeepSeek V4 Pro 0813 (max) DeepSeek · DeepSeek Pro 계열. | 오픈 가중치 | 36 | $0.67 | 81 tok/s | 1.67s | 1M | |
| 24 | DeepSeek V4 Flash Vision (max) DeepSeek · DeepSeek 비전·고속 Flash. | 멀티모달 | 35 | $0.31 | 215 tok/s | 0.94s | 1M | |
| 25 | JT-4.1 Flash 236B A21B China Mobile · 가격·속도 미공개(AA --). | 오픈 가중치 | 34 | — | — | — | 262k | |
| 26 | Qwen3.8 27B (xhigh) Alibaba · Qwen 중형 고effort. | 오픈 가중치 | 34 | $1.01 | 44 tok/s | 3.92s | 256k | |
| 27 | K2 Horizon 375B A23B Institute of Foundation Models · 가격·속도 미공개(AA --). | 오픈 가중치 | 31 | — | — | — | 524k | |
| 28 | Gemini 3.1 Pro Preview Google · Gemini Pro 프리뷰. | 멀티모달 | 30 | $0.67 | 113 tok/s | 25.9s | 1M | |
| 29 | MiniMax-M3 MiniMax · MiniMax 주력. | 대화 | 29 | $0.51 | 99 tok/s | 1.21s | 1M | |
| 30 | Quasar 438B (max) Multiverse Computing · Multiverse Computing Quasar. | 오픈 가중치 | 27 | $2.02 | 143 tok/s | 1.15s | 1M | |
| 31 | Apodex 1.1 Apodex · 속도·지연 미공개. | 대화 | 26 | $0.46 | — | — | 256k | |
| 32 | GPT-5.5 Instant OpenAI · OpenAI Instant 저지연 티어. | 대화 | 26 | $0.69 | 111 tok/s | 1.06s | 400k | |
| 33 | Inkling Small Thinking Machines · 고속·저비용 Inkling. | 대화 | 26 | $0.09 | 188 tok/s | 2.09s | 1M | |
| 34 | Kimi K2.7 Code Moonshot AI · Kimi 코딩 특화. | 코딩 | 26 | $0.54 | 83 tok/s | 2.95s | 256k | |
| 35 | Hy3 Tencent · Tencent Hy3. | 대화 | 25 | $0.07 | 88 tok/s | 3.08s | 256k | |
| 36 | Inkling (xhigh) Thinking Machines · 가격 미공개 Inkling 고effort. | 추론 | 25 | — | 160 tok/s | 1.89s | 1M | |
| 37 | Ling-3.0-flash-VL InclusionAI · 비전·Flash Ling. | 멀티모달 | 25 | — | 142 tok/s | 1.86s | 262k | |
| 38 | Qwen3.7 Plus Alibaba · Qwen Plus 티어. | 오픈 가중치 | 25 | $0.22 | 56 tok/s | 2.17s | 1M | |
| 39 | Solar Mini 4 Upstage · Upstage Solar 고속 Mini. | 대화 | 24 | $0.36 | 204 tok/s | 1.49s | 1.05M | |
| 40 | Ling-3.0-flash-Fin InclusionAI · 초고속 Ling Flash Fin. | 대화 | 23 | — | 303 tok/s | 1.75s | 262k | |
| 41 | Nemotron 3 Ultra NVIDIA · NVIDIA Nemotron. | 오픈 가중치 | 23 | $0.60 | 180 tok/s | 1.22s | 262k | |
| 42 | Gemini 3.5 Flash-Lite Google · Gemini 초고속 Lite. | 멀티모달 | 22 | $0.12 | 339 tok/s | 9.32s | 1M | |
| 43 | Ling 3.0 Flash InclusionAI · Ling Flash 기본. | 대화 | 20 | — | 325 tok/s | 2.83s | 262k | |
| 44 | LongCat 2.0 LongCat · 장문 LongCat. | 대화 | 19 | $0.06 | — | — | 1M | |
| 45 | Qwen3.5 397B A17B Alibaba · Qwen3.5 MoE 대형. | 오픈 가중치 | 18 | $0.47 | 89 tok/s | 2.27s | 262k | |
| 46 | Qwen3.6 35B A3B Alibaba · Qwen3.6 중형 MoE. | 오픈 가중치 | 18 | $0.48 | 125 tok/s | 2.10s | 262k | |
| 47 | Claude 4.5 Haiku Anthropic · Anthropic Haiku 저비용. | 대화 | 17 | $0.28 | 91 tok/s | 17.8s | 200k | |
| 48 | Muse Glimmer (high) Meta · Meta Muse 경량. | 오픈 가중치 | 17 | $0.06 | 148 tok/s | 1.42s | 131k | |
| 49 | Ring-2.6-1T InclusionAI · InclusionAI Ring. | 오픈 가중치 | 17 | $0.29 | 118 tok/s | 4.14s | 262k | |
| 50 | Qwen3.5 122B A10B Alibaba · Qwen3.5 중형. | 오픈 가중치 | 16 | $0.32 | 125 tok/s | 2.42s | 262k | |
| 51 | Gemma 4 31B Google · Google Gemma 오픈(작업당 $0 표기). | 오픈 가중치 | 15 | $0 | 36 tok/s | 1.06s | 256k | |
| 52 | Mistral Medium 3.5 Mistral AI · Mistral Medium. | 대화 | 14 | $0.50 | 165 tok/s | 2.30s | 256k |