AI 모델 랭킹
벤치마크 결과, 기능, 가격, 컨텍스트에 기반한 투명하고 설명 가능한 모델 점수.
종합 = 벤치마크 50% + 기능 20% + 가격 효율 20% + 컨텍스트 10%.
- Gemini 2.5 Pro→96.1
Google
- 벤치마크
- 92.3
- 가격 효율
- 100
- 기능
- 100
- Claude Opus 4→93.6
Anthropic
- 벤치마크
- 93
- 가격 효율
- 100
- 기능
- 85.7
- Gemini 2.5 Flash→93.3
Google
- 벤치마크
- 86.7
- 가격 효율
- 100
- 기능
- 100
- GPT-4.1→92.5
OpenAI
- 벤치마크
- 90.7
- 가격 효율
- 100
- 기능
- 85.7
- Claude Sonnet 4→92.1
Anthropic
- 벤치마크
- 90
- 가격 효율
- 100
- 기능
- 85.7
- GPT-4o→88.5
OpenAI
- 벤치마크
- 90
- 가격 효율
- 100
- 기능
- 85.7
- o3→87.9
OpenAI
- 벤치마크
- 93
- 가격 효율
- 100
- 기능
- 57.1
- DeepSeek Reasoner→79.6
DeepSeek
- 벤치마크
- 89.3
- 가격 효율
- 100
- 기능
- 42.9
- DeepSeek Chat→77.5
DeepSeek
- 벤치마크
- 85
- 가격 효율
- 100
- 기능
- 42.9
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 100
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 100
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 100
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 100
- Claude 3.5 Sonnet→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude 3.7 Sonnet→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude Haiku 4.5→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude Opus 4.8→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude Opus 5→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude Sonnet 4.6→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Claude Sonnet 5→47.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
Google
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Llama 4 Maverick→47.1
Meta
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Llama 4 Scout→47.1
Meta
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- MiniMax M3→47.1
MiniMax
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- GPT-4.1 mini→47.1
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- GPT-4.1 nano→47.1
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- GPT-5.4→47.1
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- GPT-5.5→47.1
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Grok 4→47.1
xAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- GLM-4.6→47.1
Zhipu
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- ERNIE 4.5 VL 424B→43.3
Baidu
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 85.7
- Qwen3 Coder 480B→41.4
Alibaba
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Doubao 1.5 Pro→41.4
ByteDance
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- DeepSeek V4-Flash→41.4
DeepSeek
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- DeepSeek V4-Pro→41.4
DeepSeek
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Kimi K2.5→41.4
Moonshot
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Kimi K2.6→41.4
Moonshot
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- o4-mini→41.4
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Hunyuan TurboS→41.4
Tencent
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- GLM-4.5→40.7
Zhipu
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 71.4
- Qwen3 235B→38
Alibaba
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Qwen3 32B→38
Alibaba
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Kimi K2→38
Moonshot
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Mistral Large 2→37.8
Mistral
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Mistral Large 3→37.8
Mistral
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
- Mistral Small 4→37.8
Mistral
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 57.1
Anthropic
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 0
- GPT-4o mini→26.4
OpenAI
- 벤치마크
- 0
- 가격 효율
- 100
- 기능
- 0