Clasificación de modelos de IA
Puntuaciones transparentes y explicables basadas en benchmarks, capacidades, precio y contexto.
General = Benchmark 50% + Capacidad 20% + Eficiencia de precio 20% + Contexto 10%.
- Gemini 2.5 Pro→96.1
Google
- Benchmark
- 92.3
- Eficiencia de precio
- 100
- Capacidad
- 100
- Claude Opus 4→93.6
Anthropic
- Benchmark
- 93
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Gemini 2.5 Flash→93.3
Google
- Benchmark
- 86.7
- Eficiencia de precio
- 100
- Capacidad
- 100
- GPT-4.1→92.5
OpenAI
- Benchmark
- 90.7
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Sonnet 4→92.1
Anthropic
- Benchmark
- 90
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GPT-4o→88.5
OpenAI
- Benchmark
- 90
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- o3→87.9
OpenAI
- Benchmark
- 93
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- DeepSeek Reasoner→79.6
DeepSeek
- Benchmark
- 89.3
- Eficiencia de precio
- 100
- Capacidad
- 42.9
- DeepSeek Chat→77.5
DeepSeek
- Benchmark
- 85
- Eficiencia de precio
- 100
- Capacidad
- 42.9
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 100
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 100
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 100
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 100
- Claude 3.5 Sonnet→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude 3.7 Sonnet→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Haiku 4.5→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Opus 4.8→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Opus 5→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Sonnet 4.6→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Claude Sonnet 5→47.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
Google
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Llama 4 Maverick→47.1
Meta
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Llama 4 Scout→47.1
Meta
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- MiniMax M3→47.1
MiniMax
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GPT-4.1 mini→47.1
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GPT-4.1 nano→47.1
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GPT-5.4→47.1
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GPT-5.5→47.1
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Grok 4→47.1
xAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- GLM-4.6→47.1
Zhipu
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- ERNIE 4.5 VL 424B→43.3
Baidu
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 85.7
- Qwen3 Coder 480B→41.4
Alibaba
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Doubao 1.5 Pro→41.4
ByteDance
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- DeepSeek V4-Flash→41.4
DeepSeek
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- DeepSeek V4-Pro→41.4
DeepSeek
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Kimi K2.5→41.4
Moonshot
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Kimi K2.6→41.4
Moonshot
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- o4-mini→41.4
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Hunyuan TurboS→41.4
Tencent
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- GLM-4.5→40.7
Zhipu
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 71.4
- Qwen3 235B→38
Alibaba
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Qwen3 32B→38
Alibaba
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Kimi K2→38
Moonshot
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Mistral Large 2→37.8
Mistral
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Mistral Large 3→37.8
Mistral
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
- Mistral Small 4→37.8
Mistral
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 57.1
Anthropic
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 0
- GPT-4o mini→26.4
OpenAI
- Benchmark
- 0
- Eficiencia de precio
- 100
- Capacidad
- 0