Ranking de IA

Ranking de las mejores IA

La clasificación general: cinco capacidades reunidas en una sola puntuación, para comparar los modelos en su conjunto y no por una única tarea. Se construye con comparaciones a ciegas hechas por personas reales, así que responde a qué modelo prefieren más a menudo, no a cuántas tareas resolvió. Para una habilidad concreta, la selección dedicada es más precisa.

100 modelos en la tabla
235 considerados en el cálculo
27 julio 2026 lanzamiento del modelo más nuevo aquí
7 agosto 2026 último recálculo
# Modelo Desarrollador Puntuación global Acceso$ / 1M Salida$ / 1M Contextotokens código25 % matemáticas15 % conocimientos20 % razonamiento20 % idioma20 %
1 Claude Opus 5 Anthropic 99,44 94–100 $5 $25 1.000K 99,9 100 97,9 100
2 Claude Opus 4.6 Anthropic 98,59 97–99 $5 $25 1.000K 100 93,2 100 98,1 100
3 Claude Fable 5 Anthropic 97,57 95–99 $10 $50 1.000K 97 98,1 98,2 96,4 98,5
4 Claude Opus 4.7 Anthropic 94,28 93–96 $5 $25 1.000K 96,5 89,6 97,5 93,7 92,4
5 Gemini 3.5 Flash Google DeepMind 93,13 90–96 $1,5 $9 1.049K 91,9 96,2 95,3 91,3 92
6 Gemini 3.6 Flash Google DeepMind 92,86 89–96 $1,5 $7,5 1.049K 92,6 93,3 94,2 91,6
7 Kimi K3 Moonshot AI (Kimi) 92,55 89–96 $2 $8 1.049K 93,4 92,9 91,2
8 MiMo V2.5 Pro Xiaomi 91,63 90–94 $0,44 $0,87 1.050K 93,1 87,6 94,3 91,3 90,5
9 Muse Spark 1.1 Meta AI 91,32 88–95 $1,25 $4,25 1.049K 92,6 86,3 91,3 91,4 93,5
10 Gemini 3.1 Pro Preview Google DeepMind 91,3 90–93 $2 $12 1.049K 90,4 89,7 91,4 91,1 93,7
11 Claude Sonnet 4.6 Anthropic 91,22 90–93 $3 $15 1.000K 93,9 84,5 93,9 91,2 90,3
12 ERNIE 5.1 Baidu (Ernie) 90,91 89–93 $0,75 $3 119K 91,3 87,8 91,4 90,4 92,8
13 Gemini 3 Pro Google DeepMind 90,16 88–92 $1,6 $9,6 1.049K 90,2 87,3 90,3 90,7 91,6
14 GPT-5.6 Terra OpenAI 90,12 86–94 $2 $12 1.050K 91,3 86,6 94,7 88,4 88,4
15 GLM 5.1 Zhipu AI / Z.ai 90,07 88–92 $0,06 $0,22 205K 92,1 87,8 90,9 89,5 89
16 Kimi K2.6 Moonshot AI (Kimi) 89,93 88–92 $0,22 $1,14 262K 91 87 92 88,4 90,4
17 Claude 4.5 Opus Anthropic 89,72 88–91 $5 $25 200K 93,1 84,2 91,4 89,4 88,4
18 GLM 5.2 Zhipu AI / Z.ai 89,28 87–92 $0,42 $1,32 1.049K 89,2 86,4 88,5 88,9 92,7
19 Claude Opus 4.8 Anthropic 89,23 87–91 $5 $25 1.000K 90,7 85,5 91,8 89,1 87,6
20 Grok 4.5 xAI 88,66 85–92 $2 $6 500K 89,5 88,8 89,9 87,3 87,7
21 Qwen3.7 Plus Alibaba (Qwen) 88,55 86–91 $0,5 $3 1.000K 90 86 88,3 87,3 90,1
22 Claude Sonnet 5 Anthropic 88,27 85–91 $2 $10 1.000K 90,7 84,8 93 87 84,3
23 GPT-5.6 Sol OpenAI 88,04 84–92 $5 $30 1.050K 90,8 83 94,6 89,6 80,3
24 Inkling Thinking Machines Lab 87,88 84–92 $1,87 $4,68 1.049K 87,3 87,7 88,3 85,1 91,2
25 Gemini 3 Flash Google DeepMind 87,58 85–90 $0,4 $2,4 1.049K 86,4 86,9 87,4 87,5 89,9
26 MiMo V2 Pro Xiaomi 87,53 85–90 $0,44 $0,87 1.049K 89 82 90 86,3 88,6
27 Kimi K2.5 Thinking TEE Moonshot AI (Kimi) 87,47 86–89 $0,3 $1,9 256K 88,5 86,3 87,9 85,6 88,6
28 Qwen3.6 Max Preview Alibaba (Qwen) 87,2 83–92 $1,3 $7,8 262K 87,3 84,7 89,2 85,9 88,3
29 Claude Sonnet 4.5 Anthropic 87,2 86–89 $3 $15 1.000K 90,7 77,1 89 87 88,9
30 DeepSeek V4 Pro DeepSeek 86,58 85–88 $0,44 $0,87 1.049K 87,9 81 87,6 86,8 87,9
31 Hy3 Tencent (Hunyuan) 86,42 83–90 $0,13 $0,53 262K 87,3 87,1 84,6
32 GPT-5.6 Luna OpenAI 86,36 82–90 $0,2 $1,2 1.050K 88,1 82,4 90,3 85,4 84,2
33 Gemini 2.5 Pro Google DeepMind 86,17 85–87 $1,25 $10 1.049K 84,5 82,5 86 85,7 91,7
34 Qwen3.5 397B-A17B Alibaba (Qwen) 86,17 85–88 $0,6 $3,6 262K 87 82,2 88,1 84,7 87,7
35 Qwen3 Max Preview Alibaba (Qwen) 86,09 84–89 $1,2 $6 256K 85,4 82,4 86,9 84,6 90,4
36 Gemma 4 31B Google DeepMind 85,79 82–90 $0,14 $0,4 262K 85 85,4 85,4 84 89,2
37 Seed 2.0 Pro ByteDance (Doubao) 85,77 84–87 $0,5 $3 131K 88 80,3 83,6 85,6 89,6
38 GLM 5V Turbo Zhipu AI / Z.ai 85,64 82–89 $0,7 $3,1 203K 87,3 83,2 85,1 83,7 87,8
39 MiniMax M3 MiniMax 85,52 83–88 $0,3 $1,2 1.049K 88,3 80,9 88,4 84,6 83,5
40 GLM 5 Zhipu AI / Z.ai 85,23 83–87 $0,48 $1,9 205K 86 80,2 86,3 85,1 87,1
41 Qwen3.6 Plus Alibaba (Qwen) 85,2 83–87 $0,5 $3 1.000K 87 82,6 86,4 84,5 84,4
42 Grok 4.20 (Reasoning) xAI 85,16 84–87 $2 $6 2.000K 85,7 83,7 83,3 85,2 87,5
43 Grok 4.20 Multi Agent Beta 0309 xAI 84,68 83–86 $2 $6 2.000K 85,5 80,4 84,5 84,6 87,2
44 MiMo V2.5 Xiaomi 84,5 83–86 $0,14 $0,28 1.050K 87,7 80,5 87,2 84,8 80,5
45 Longcat Flash Chat Meituan 84,25 81–88 131K 87,4 80,7 83,2 81,7 86,6
46 MiMo V2 Omni Xiaomi 84,12 81–87 $0,14 $0,28 262K 86,9 79 84,3 83,6 84,8
47 Gemma 4 26B-A4B Google DeepMind 83,89 80–87 $0,05 $0,29 262K 82,9 85,5 84,9 82,9
48 Claude 4.1 Opus Anthropic 83,83 82–85 $15 $75 200K 88,4 77,1 80,9 83,2 86,7
49 DeepSeek V4 Flash DeepSeek 83,69 82–86 $0,14 $0,28 1.049K 85,2 78,2 84,1 83,7 85,5
50 GPT-5.2 Chat OpenAI 83,03 81–85 $1,75 $14 128K 83,4 79,4 83,3 84 84,1
51 GLM 4.6 Zhipu AI / Z.ai 82,96 81–85 $0,29 $1,14 205K 83,9 79,1 82,5 83,1 85
52 Qwen3 235B A22B Instruct 2507 Alibaba (Qwen) 82,35 81–84 $0,1 $0,1 262K 83,1 78,9 84,2 81,8 82,8
53 Gemini 3.5 Flash Lite Google DeepMind 82,28 79–86 $0,3 $2,5 1.049K 85,1 75,8 82,6 83,3
54 DeepSeek V3.2 DeepSeek 82,25 80–84 $0,28 $0,4 164K 83,8 79,8 82,6 81,8 82,3
55 Qwen3 Next 80B A3B Instruct Alibaba (Qwen) 82,1 79–85 $0,15 $1,2 262K 82,4 80,9 78,4 80,8 87,6
56 Mistral Medium 3.5 Mistral AI 82,01 79–85 $1,5 $7,5 262K 86 79,3 82,5 82,4 78,2
57 GLM 4.5 Zhipu AI / Z.ai 81,99 79–85 $0,2 $0,8 131K 80,9 78,1 81,4 80,9 87,9
58 GLM 4.7 Zhipu AI / Z.ai 81,87 78–85 $0,15 $0,8 205K 85,1 77,4 80 83,7 81,2
59 Mistral Large 3 Mistral AI 81,8 80–84 $0,5 $1,5 256K 82,9 75,9 80 81,2 87,3
60 Kimi K2 Thinking Turbo Moonshot AI (Kimi) 81,58 80–83 $1,15 $8 262K 84,7 78,5 83,1 80,7 79,4
61 Qwen3 VL 235B A22B Instruct Alibaba (Qwen) 81,32 78–85 $0,4 $1,6 262K 82,2 77,9 84,6 81,2 79,7
62 MiniMax M2.7 MiniMax 81,1 79–83 $0,3 $1,2 205K 84,3 76,8 83,1 79,7 79,8
63 Grok 4.1 xAI 80,98 79–83 $2 $10 200K 83 76,3 79 82,3 82,6
64 Qwen3.5 122B-A10B Alibaba (Qwen) 80,84 79–83 $0,4 $3,2 262K 81,4 78,4 82,5 79,6 81,6
65 Claude Haiku 4.5 Anthropic 80,73 79–82 $1 $5 200K 84,2 71,7 84,1 78,9 81,7
66 DeepSeek V3.2 Exp DeepSeek 80,66 77–84 $0,22 $0,33 164K 80,9 77,6 76,7 81,1 86,2
67 GPT-5.5 Instant OpenAI 80,6 78–83 $5 $30 400K 81,1 77,4 79,2 80,6 83,8
68 Mistral Medium 3.1 Mistral AI 80,06 79–81 $0,4 $2 262K 81,2 75 78,2 80,6 83,7
69 MiMo V2 Flash Xiaomi 79,8 78–82 $0,14 $0,28 262K 82,4 72,3 81,2 79,3 81,4
70 Qwen3.5 27B Alibaba (Qwen) 79,6 77–82 $0,3 $2,4 262K 79,3 79,3 80,9 78,1 80,3
71 Step 3.5 Flash StepFun 79,56 78–81 $0,1 $0,3 262K 81,6 74,3 80,6 77,8 81,8
72 Gemini 2.5 Flash Google DeepMind 79,46 78–81 $0,3 $2,5 1.049K 79,1 75 80,9 79,8 81,7
73 Qwen3 Max 2025-09-23 Alibaba (Qwen) 79,31 76–83 $0,86 $3,43 258K 82 80,3 76,2 80,2 77,4
74 Qwen3 235B A22B Thinking-2507 Alibaba (Qwen) 79,25 75–84 $0,1 $0,1 262K 79,1 75,5 86,2 78,5 76
75 ChatGPT 4o Latest OpenAI 78,79 77–80 $5 $15 128K 77,4 74,1 76,5 80,2 85
76 Grok 4 xAI 78,19 76–80 $3 $15 256K 76,3 77,6 79,6 77,2 80,6
77 DeepSeek V3.1 DeepSeek 78,07 75–81 $0,2 $0,7 164K 77,4 77 77,1 78,4 80,3
78 DeepSeek R1 0528 DeepSeek 77,75 74–81 $0,25 $0,25 164K 79,7 73,8 76,1 78,5 79,1
79 Qwen3 VL 235B A22B Thinking Alibaba (Qwen) 77,74 74–82 $0,4 $4 262K 79,9 75,8 80,1 77,1 74,9
80 Gemini 3.1 Flash Lite Preview Google DeepMind 77,67 76–79 $0,25 $1,5 1.049K 74,6 78,9 76,3 76,9 82,8
81 Grok 4 Fast Reasoning xAI 77,42 75–80 $0,2 $0,5 2.000K 78,1 73,7 77,9 76,2 80,1
82 2025) Google DeepMind 77,32 75–80 $0,3 $2,5 1.049K 75 76,1 80,9 77,3 77,6
83 Grok 4.1 Fast Reasoning xAI 77,16 75–79 $0,2 $0,5 2.000K 76,9 74 76,8 77,1 80,3
84 Qwen3.5 Flash Alibaba (Qwen) 77,04 75–79 $0,09 $0,36 1.000K 77,2 74,8 78,5 76,4 77,7
85 o3 2025-04-16 OpenAI 76,15 74–78 $2 $8 200K 76,2 77,6 76,6 76 74,7
86 Qwen3.5 35B A3B Alibaba (Qwen) 76,15 74–78 $0,25 $2 262K 76,4 74 77,8 75,7 76,2
87 GPT 5 Chat OpenAI 75,84 73–78 $1,25 $10 128K 74,7 74,7 77,8 76,6 75,4
88 Grok 4.3 xAI 75,75 74–78 $1,25 $2,5 1.000K 77,6 71,4 74,4 75,6 78,3
89 Qwen3 30B A3B Instruct 2507 Alibaba (Qwen) 75,63 73–78 $0,05 $0,19 262K 77,9 72,1 75,1 75,2 76,4
90 Nemotron 3 Super NVIDIA 75,6 72–79 $0,2 $0,8 1.000K 75,8 69,8 76,1 73,5 81,4
91 MiMo V2 Flash (Thinking) Xiaomi 75,58 72–79 $0,1 $0,31 256K 77,9 69,1 77,1 76,5 75,1
92 DeepSeek V3.1 Terminus DeepSeek 75,4 71–80 $0,21 $0,79 164K 75,9 72,8 76,7
93 GPT 4.5 Preview OpenAI 75,22 72–78 $75 $150 128K 74,1 75,3 75,5 76,3
94 GPT-5.3 Chat (latest) OpenAI 74,18 72–76 $1,75 $14 128K 75,8 70,2 76 75,1 72,4
95 NVIDIA Nemotron 3 Super 120B A12B NVIDIA 74,16 71–77 $0,15 $0,65 262K 75,8 69,8 76,1 73,5
96 Hunyuan T1 Tencent (Hunyuan) 74,09 69–79 131K 72,3 74,9 74,5 75,4
97 Kimi K2 0905 Preview Moonshot AI (Kimi) 73,01 69–77 $0,6 $2,5 262K 74,6 72,6 70,9 72,4 74,1
98 GLM 4.5 Air Zhipu AI / Z.ai 72,46 70–75 $0,11 $0,29 131K 74 72,6 71,3 71,6 72,4
99 Ling Flash 2.0 Ant Group (Ling) 71,63 67–76 $0,14 $0,57 131K 73 67,6 69 68,9 78,3
100 Claude 4 Opus Anthropic 71,15 69–73 $15 $75 200K 75 68,1 71,6 71,2 68,2

La tabla se desplaza en horizontal: no caben todas las columnas.

Las columnas de la derecha son los sumandos de la puntuación, llevados a una escala común de 0 a 100 según la dispersión real entre los modelos medidos. Sumados con los pesos indicados, dan la cifra de la columna principal: en ellos se ve en qué exactamente un modelo superó a otro. Un guion significa «no medido», no cero.

El precio es el más bajo entre los proveedores del modelo, tarifa base, sin tarifas por lotes ni reducidas. La entrada y la salida se muestran por separado a propósito: en la mayoría de los modelos la salida cuesta varias veces más que la entrada, y la factura final depende de qué predomine en la tarea.

El signo ≈ marca los modelos cuyo intervalo de confianza se solapa con el de la fila de arriba. Aquí hay 99 modelos — su orden entre sí no está determinado por los datos disponibles.

El intervalo de confianza de la mitad de los modelos supera 4,5 puntos — es decir, unas 16 filas adyacentes de la tabla. Dentro de ese grupo el orden no lo marcan los datos, sino quién votó esta vez; los datos sostienen la diferencia entre el principio y el final de la lista, pero no la vecindad de los puestos.