Volver a AI Coding

Ranking de modelos de IA

Ranking de modelos de IA para código

Top 50 de Artificial Analysis.

Instantánea: 2026-10-03 · Última revisión: 2026-10-03

Metodología

Las métricas siguen una instantánea del leaderboard público de LLM de Artificial Analysis: el Índice de Inteligencia, el coste por tarea y la velocidad reflejan el rendimiento en benchmark en la fecha de la instantánea. El precio, la disponibilidad y las posiciones de los proveedores cambian con frecuencia, y una puntuación alta en benchmark no garantiza el mejor resultado para un codebase o flujo concreto.

Fuente
Artificial Analysis
Última revisión
2026-10-03

Top 50 modelos

01

Modelo de razonamiento actual

Anthropic - Claude Opus - 5.5 (max)

Claude Opus 5.5 max lidera esta instantánea con Intelligence Index 58, contexto de 1M y coste por tarea $5.98. La mediana es 93 tok/s y el primer chunk es 689.18s.

Ideal para: Trabajo Claude Opus de máximo esfuerzo cuando el índice más alto importa más que un primer chunk corto.

Anthropic

Contexto
1M
Índice AA
58
Coste por tarea
$5.98
Velocidad
93 tok/s
Primer chunk
689.18s
Respuesta total
694.56s
02

Modelo de razonamiento actual

Anthropic - Claude Sonnet - 5.5 (max)

Claude Sonnet 5.5 max queda en el #2 con Intelligence Index 56 y contexto de 1M. El coste por tarea es $7.67, el más alto del top 10, y el primer chunk es 428.36s.

Ideal para: Trabajo Claude Sonnet de máximo esfuerzo cuando el índice importa más que el coste y la espera.

Anthropic

Contexto
1M
Índice AA
56
Coste por tarea
$7.67
Velocidad
139 tok/s
Primer chunk
428.36s
Respuesta total
431.95s
03

Modelo de razonamiento actual

Anthropic - Claude Opus - 5.5 (xhigh)

Claude Opus 5.5 xhigh empata con Sonnet 5.5 max en Intelligence Index 56, con contexto de 1M y coste por tarea $3.46. El primer chunk es 140.81s, más corto que Sonnet 5.5 max.

Ideal para: Codificación Opus 5.5 de alto esfuerzo cuando el índice debe igualar a Sonnet 5.5 max con menor coste.

Anthropic

Contexto
1M
Índice AA
56
Coste por tarea
$3.46
Velocidad
83 tok/s
Primer chunk
140.81s
Respuesta total
146.82s
04

Modelo de razonamiento actual

Anthropic - Claude Opus - 5.5 (high)

Claude Opus 5.5 high queda en el #4 con Intelligence Index 54 y contexto de 1M. El coste por tarea es $1.82 y el primer chunk es 37.37s, muy por debajo de Opus 5.5 xhigh.

Ideal para: Codificación Claude Opus 5.5 que aún necesita un índice alto sin la espera del tier xhigh.

Anthropic

Contexto
1M
Índice AA
54
Coste por tarea
$1.82
Velocidad
80 tok/s
Primer chunk
37.37s
Respuesta total
43.64s
05

Modelo de razonamiento actual

Anthropic - Claude Fable - 5.1 (max)

Claude Fable 5.1 max queda en el #5 con Intelligence Index 53 y contexto de 1M. El coste por tarea es $7.63, justo por debajo de Sonnet 5.5 max, y el primer chunk es 186.52s.

Ideal para: Trabajo Claude Fable de máximo esfuerzo cuando el índice importa más que el coste y la espera.

Anthropic

Contexto
1M
Índice AA
53
Coste por tarea
$7.63
Velocidad
67 tok/s
Primer chunk
186.52s
Respuesta total
193.93s
06

Modelo de razonamiento actual

Anthropic - Claude Fable - 5.1 (xhigh)

Claude Fable 5.1 xhigh se mantiene en Intelligence Index 53, empatado con Fable 5.1 max, con contexto de 1M y coste por tarea $5.98. El primer chunk es 96.75s, más corto que Fable 5.1 max.

Ideal para: Codificación Fable 5.1 de alto esfuerzo cuando el coste max es demasiado alto y el índice debe seguir igual.

Anthropic

Contexto
1M
Índice AA
53
Coste por tarea
$5.98
Velocidad
66 tok/s
Primer chunk
96.75s
Respuesta total
104.30s
07

Modelo de razonamiento actual

OpenAI - GPT Astra - 6 (max)

GPT-6 Astra max queda en el #7 con Intelligence Index 53 y contexto de 1M. El coste por tarea es $3.26, por debajo de Fable 5.1 max, y el primer chunk es 319.00s.

Ideal para: Agentes de frontera centrados en OpenAI que pueden absorber una espera muy larga en el primer chunk.

OpenAI

Contexto
1M
Índice AA
53
Coste por tarea
$3.26
Velocidad
54 tok/s
Primer chunk
319.00s
Respuesta total
328.32s
08

Modelo actual; métricas parciales

Google - Gemini - 4 Argon (high)

Gemini 4 Argon high queda en el #8 con Intelligence Index 53, empatado con varios modelos en 53, contexto de 1M y coste por tarea $1.99. La velocidad y la latencia aún no están publicadas.

Ideal para: Codificación de frontera en Google cuando el índice importa más que la velocidad publicada.

Google

Contexto
1M
Índice AA
53
Coste por tarea
$1.99
Velocidad
— tok/s
Primer chunk
—
Respuesta total
—
09

Modelo de razonamiento actual

OpenAI - GPT Astra - 6 (xhigh)

GPT-6 Astra xhigh queda en el #9 con Intelligence Index 52, contexto de 1M y coste por tarea $2.31. El primer chunk es 144.37s, más corto que Astra max.

Ideal para: Agentes de código OpenAI que necesitan calidad Astra cerca del max con menor coste.

OpenAI

Contexto
1M
Índice AA
52
Coste por tarea
$2.31
Velocidad
49 tok/s
Primer chunk
144.37s
Respuesta total
154.50s
10

Modelo de razonamiento actual

Anthropic - Claude Sonnet - 5.5 (xhigh)

Claude Sonnet 5.5 xhigh queda en el #10 con Intelligence Index 52 y contexto de 1M. El coste por tarea es $2.75, la mediana es 104 tok/s y el primer chunk es 33.63s, muy por debajo de Sonnet 5.5 max.

Ideal para: Codificación Claude Sonnet 5.5 que aún necesita un índice alto sin la espera del tier max.

Anthropic

Contexto
1M
Índice AA
52
Coste por tarea
$2.75
Velocidad
104 tok/s
Primer chunk
33.63s
Respuesta total
38.45s
11

Modelo de razonamiento actual

OpenAI - GPT Sol - 6.1 (max)

OpenAI GPT Sol 6.1 (max) en esta instantánea: Intelligence Index 52, contexto 1M, coste por tarea $0.72, mediana 57 tok/s y primer chunk 282.35s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
52
Coste por tarea
$0.72
Velocidad
57 tok/s
Primer chunk
282.35s
Respuesta total
291.13s
12

Modelo de razonamiento actual

Anthropic - Claude Opus - 5.5 (medium)

Anthropic Claude Opus 5.5 (medium) en esta instantánea: Intelligence Index 51, contexto 1M, coste por tarea $1.34, mediana 73 tok/s y primer chunk 25.24s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
51
Coste por tarea
$1.34
Velocidad
73 tok/s
Primer chunk
25.24s
Respuesta total
32.06s
13

Modelo de razonamiento actual

Anthropic - Claude Fable - 5.1 (high)

Anthropic Claude Fable 5.1 (high) en esta instantánea: Intelligence Index 51, contexto 1M, coste por tarea $3.91, mediana 56 tok/s y primer chunk 25.00s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
51
Coste por tarea
$3.91
Velocidad
56 tok/s
Primer chunk
25.00s
Respuesta total
33.93s
14

Modelo de razonamiento actual

OpenAI - GPT Sol - 6.1 (xhigh)

OpenAI GPT Sol 6.1 (xhigh) en esta instantánea: Intelligence Index 51, contexto 1M, coste por tarea $0.39, mediana 51 tok/s y primer chunk 128.47s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
51
Coste por tarea
$0.39
Velocidad
51 tok/s
Primer chunk
128.47s
Respuesta total
138.37s
15

Modelo de razonamiento actual

OpenAI - GPT Astra - 6 (high)

OpenAI GPT Astra 6 (high) en esta instantánea: Intelligence Index 51, contexto 1M, coste por tarea $1.73, mediana 48 tok/s y primer chunk 65.56s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
51
Coste por tarea
$1.73
Velocidad
48 tok/s
Primer chunk
65.56s
Respuesta total
76.04s
16

Modelo de razonamiento actual

OpenAI - GPT Sol - 6.1 (high)

OpenAI GPT Sol 6.1 (high) en esta instantánea: Intelligence Index 50, contexto 1M, coste por tarea $0.32, mediana 50 tok/s y primer chunk 57.71s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
50
Coste por tarea
$0.32
Velocidad
50 tok/s
Primer chunk
57.71s
Respuesta total
67.64s
17

Modelo de razonamiento actual

OpenAI - GPT Astra - 6 (medium)

OpenAI GPT Astra 6 (medium) en esta instantánea: Intelligence Index 50, contexto 1M, coste por tarea $1.54, mediana 46 tok/s y primer chunk 4.70s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
50
Coste por tarea
$1.54
Velocidad
46 tok/s
Primer chunk
4.70s
Respuesta total
15.65s
18

Modelo de razonamiento actual

Anthropic - Claude Fable - 5.1 (medium)

Anthropic Claude Fable 5.1 (medium) en esta instantánea: Intelligence Index 49, contexto 1M, coste por tarea $2.98, mediana 57 tok/s y primer chunk 9.11s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
49
Coste por tarea
$2.98
Velocidad
57 tok/s
Primer chunk
9.11s
Respuesta total
17.85s
19

Modelo de razonamiento actual

Meta - Muse Spark - 1.3 (max)

Meta Muse Spark 1.3 (max) en esta instantánea: Intelligence Index 48, contexto 1M, coste por tarea $1.60, mediana 135 tok/s y primer chunk 52.46s.

Ideal para: Agentes de código Meta, trabajo de contexto largo y comparación por instantánea.

Meta

Contexto
1M
Índice AA
48
Coste por tarea
$1.60
Velocidad
135 tok/s
Primer chunk
52.46s
Respuesta total
71.04s
20

Modelo de razonamiento actual

OpenAI - GPT Sol - 6.1 (medium)

OpenAI GPT Sol 6.1 (medium) en esta instantánea: Intelligence Index 48, contexto 1M, coste por tarea $0.21, mediana 45 tok/s y primer chunk 5.29s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
48
Coste por tarea
$0.21
Velocidad
45 tok/s
Primer chunk
5.29s
Respuesta total
16.30s
21

Modelo de razonamiento actual

Anthropic - Claude Fable - 5.1 (low)

Anthropic Claude Fable 5.1 (low) en esta instantánea: Intelligence Index 47, contexto 1M, coste por tarea $2.37, mediana 55 tok/s y primer chunk 4.73s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
47
Coste por tarea
$2.37
Velocidad
55 tok/s
Primer chunk
4.73s
Respuesta total
13.80s
22

Modelo de razonamiento actual

Anthropic - Claude Sonnet - 5.5 (high)

Anthropic Claude Sonnet 5.5 (high) en esta instantánea: Intelligence Index 47, contexto 1M, coste por tarea $1.12, mediana 102 tok/s y primer chunk 12.19s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
47
Coste por tarea
$1.12
Velocidad
102 tok/s
Primer chunk
12.19s
Respuesta total
17.09s
23

Modelo de razonamiento actual

SpaceXAI - Grok - 4.7 (xhigh)

SpaceXAI Grok 4.7 (xhigh) en esta instantánea: Intelligence Index 46, contexto 500k, coste por tarea $3.74, mediana 79 tok/s y primer chunk 41.26s.

Ideal para: Agentes de código SpaceXAI, trabajo de contexto largo y comparación por instantánea.

SpaceXAI

Contexto
500k
Índice AA
46
Coste por tarea
$3.74
Velocidad
79 tok/s
Primer chunk
41.26s
Respuesta total
47.59s
24

Modelo de razonamiento actual

SpaceXAI - Grok - 4.7 (high)

SpaceXAI Grok 4.7 (high) en esta instantánea: Intelligence Index 46, contexto 500k, coste por tarea $2.73, mediana 78 tok/s y primer chunk 33.12s.

Ideal para: Agentes de código SpaceXAI, trabajo de contexto largo y comparación por instantánea.

SpaceXAI

Contexto
500k
Índice AA
46
Coste por tarea
$2.73
Velocidad
78 tok/s
Primer chunk
33.12s
Respuesta total
39.49s
25

Modelo de razonamiento actual

Xiaomi - MiMo - V2.6 Pro

Xiaomi MiMo V2.6 Pro en esta instantánea: Intelligence Index 46, contexto 1M, coste por tarea $0.13, mediana 45 tok/s y primer chunk 3.82s.

Ideal para: Agentes de código Xiaomi, trabajo de contexto largo y comparación por instantánea.

Xiaomi

Contexto
1M
Índice AA
46
Coste por tarea
$0.13
Velocidad
45 tok/s
Primer chunk
3.82s
Respuesta total
59.44s
26

Modelo de razonamiento actual

OpenAI - GPT Astra - 6 (low)

OpenAI GPT Astra 6 (low) en esta instantánea: Intelligence Index 46, contexto 1M, coste por tarea $0.82, mediana 47 tok/s y primer chunk 2.75s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
46
Coste por tarea
$0.82
Velocidad
47 tok/s
Primer chunk
2.75s
Respuesta total
13.34s
27

Modelo de razonamiento actual

Alibaba - Qwen - 3.8 Max (0902)

Alibaba Qwen 3.8 Max (0902) en esta instantánea: Intelligence Index 45, contexto 984k, coste por tarea $5.41, mediana 38 tok/s y primer chunk 2.67s.

Ideal para: Agentes de código Alibaba, trabajo de contexto largo y comparación por instantánea.

Alibaba

Contexto
984k
Índice AA
45
Coste por tarea
$5.41
Velocidad
38 tok/s
Primer chunk
2.67s
Respuesta total
68.62s
28

Modelo de razonamiento actual

Meta - Muse Spark - 1.3 (xhigh)

Meta Muse Spark 1.3 (xhigh) en esta instantánea: Intelligence Index 45, contexto 1M, coste por tarea $1.37, mediana 146 tok/s y primer chunk 41.50s.

Ideal para: Agentes de código Meta, trabajo de contexto largo y comparación por instantánea.

Meta

Contexto
1M
Índice AA
45
Coste por tarea
$1.37
Velocidad
146 tok/s
Primer chunk
41.50s
Respuesta total
58.68s
29

Modelo de razonamiento actual

Z AI - GLM - 5.3 (max)

Z AI GLM 5.3 (max) en esta instantánea: Intelligence Index 45, contexto 1M, coste por tarea $2.01, mediana 74 tok/s y primer chunk 3.18s.

Ideal para: Agentes de código Z AI, trabajo de contexto largo y comparación por instantánea.

Z AI

Contexto
1M
Índice AA
45
Coste por tarea
$2.01
Velocidad
74 tok/s
Primer chunk
3.18s
Respuesta total
36.90s
30

Modelo de razonamiento actual

StepFun - Step - 5 Preview

StepFun Step 5 Preview en esta instantánea: Intelligence Index 44, contexto 1M, coste por tarea $0.72, mediana 85 tok/s y primer chunk 3.03s.

Ideal para: Agentes de código StepFun, trabajo de contexto largo y comparación por instantánea.

StepFun

Contexto
1M
Índice AA
44
Coste por tarea
$0.72
Velocidad
85 tok/s
Primer chunk
3.03s
Respuesta total
32.40s
31

Modelo de razonamiento actual

Kimi - Kimi - K3 (max)

Kimi Kimi K3 (max) en esta instantánea: Intelligence Index 44, contexto 1.05M, coste por tarea $2.00, mediana 36 tok/s y primer chunk 4.12s.

Ideal para: Agentes de código Kimi, trabajo de contexto largo y comparación por instantánea.

Kimi

Contexto
1.05M
Índice AA
44
Coste por tarea
$2.00
Velocidad
36 tok/s
Primer chunk
4.12s
Respuesta total
72.72s
32

Modelo de razonamiento actual

Anthropic - Claude Opus - 5.5 (low)

Anthropic Claude Opus 5.5 (low) en esta instantánea: Intelligence Index 42, contexto 1M, coste por tarea $0.55, mediana 80 tok/s y primer chunk 9.94s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
42
Coste por tarea
$0.55
Velocidad
80 tok/s
Primer chunk
9.94s
Respuesta total
16.18s
33

Modelo de razonamiento actual

SpaceXAI - Grok - 4.7 (low)

SpaceXAI Grok 4.7 (low) en esta instantánea: Intelligence Index 42, contexto 500k, coste por tarea $1.25, mediana 75 tok/s y primer chunk 8.62s.

Ideal para: Agentes de código SpaceXAI, trabajo de contexto largo y comparación por instantánea.

SpaceXAI

Contexto
500k
Índice AA
42
Coste por tarea
$1.25
Velocidad
75 tok/s
Primer chunk
8.62s
Respuesta total
15.25s
34

Modelo de razonamiento actual

OpenAI - GPT Sol - 6.1 (low)

OpenAI GPT Sol 6.1 (low) en esta instantánea: Intelligence Index 42, contexto 1M, coste por tarea $0.13, mediana 48 tok/s y primer chunk 3.37s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
42
Coste por tarea
$0.13
Velocidad
48 tok/s
Primer chunk
3.37s
Respuesta total
13.78s
35

Modelo de razonamiento actual

OpenAI - GPT Terra - 5.6 (max)

OpenAI GPT Terra 5.6 (max) en esta instantánea: Intelligence Index 42, contexto 1M, coste por tarea $1.40, mediana 102 tok/s y primer chunk 172.37s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
42
Coste por tarea
$1.40
Velocidad
102 tok/s
Primer chunk
172.37s
Respuesta total
177.28s
36

Modelo de razonamiento actual

Z AI - GLM - 5.3 Flash

Z AI GLM 5.3 Flash en esta instantánea: Intelligence Index 42, contexto 1M, coste por tarea $0.25, mediana 53 tok/s y primer chunk 3.29s.

Ideal para: Agentes de código Z AI, trabajo de contexto largo y comparación por instantánea.

Z AI

Contexto
1M
Índice AA
42
Coste por tarea
$0.25
Velocidad
53 tok/s
Primer chunk
3.29s
Respuesta total
50.21s
37

Modelo de razonamiento actual

Google - Gemini - 3.8 Flash (high)

Google Gemini 3.8 Flash (high) en esta instantánea: Intelligence Index 41, contexto 1M, coste por tarea $1.24, mediana 242 tok/s y primer chunk 16.13s.

Ideal para: Agentes de código Google, trabajo de contexto largo y comparación por instantánea.

Google

Contexto
1M
Índice AA
41
Coste por tarea
$1.24
Velocidad
242 tok/s
Primer chunk
16.13s
Respuesta total
18.19s
38

Modelo de razonamiento actual

Anthropic - Claude Sonnet - 5.5 (medium)

Anthropic Claude Sonnet 5.5 (medium) en esta instantánea: Intelligence Index 41, contexto 1M, coste por tarea $0.59, mediana 107 tok/s y primer chunk 1.21s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
41
Coste por tarea
$0.59
Velocidad
107 tok/s
Primer chunk
1.21s
Respuesta total
5.88s
39

Modelo de razonamiento actual

Alibaba - Qwen - 3.8 2.4T A95B

Alibaba Qwen 3.8 2.4T A95B en esta instantánea: Intelligence Index 40, contexto 262k, coste por tarea $2.16, mediana 39 tok/s y primer chunk 2.78s.

Ideal para: Agentes de código Alibaba, trabajo de contexto largo y comparación por instantánea.

Alibaba

Contexto
262k
Índice AA
40
Coste por tarea
$2.16
Velocidad
39 tok/s
Primer chunk
2.78s
Respuesta total
66.94s
40

Modelo de razonamiento actual

Alibaba - Qwen - 3.8 Flash Next

Alibaba Qwen 3.8 Flash Next en esta instantánea: Intelligence Index 40, contexto 256k, coste por tarea $0.37, mediana 54 tok/s y primer chunk 2.45s.

Ideal para: Agentes de código Alibaba, trabajo de contexto largo y comparación por instantánea.

Alibaba

Contexto
256k
Índice AA
40
Coste por tarea
$0.37
Velocidad
54 tok/s
Primer chunk
2.45s
Respuesta total
48.98s
41

Modelo actual; métricas parciales

Google - Gemini - 3.8 Flash (medium)

Google Gemini 3.8 Flash (medium) en esta instantánea: Intelligence Index 40, contexto 1M y coste por tarea $0.93. La velocidad y la latencia aún no están publicadas.

Ideal para: Agentes de código Google, trabajo de contexto largo y comparación por instantánea.

Google

Contexto
1M
Índice AA
40
Coste por tarea
$0.93
Velocidad
— tok/s
Primer chunk
—
Respuesta total
—
42

Modelo de razonamiento actual

DeepSeek - DeepSeek - V4.1 Flash (max)

DeepSeek DeepSeek V4.1 Flash (max) en esta instantánea: Intelligence Index 39, contexto 1M, coste por tarea $0.27, mediana 224 tok/s y primer chunk 1.02s.

Ideal para: Agentes de código DeepSeek, trabajo de contexto largo y comparación por instantánea.

DeepSeek

Contexto
1M
Índice AA
39
Coste por tarea
$0.27
Velocidad
224 tok/s
Primer chunk
1.02s
Respuesta total
12.21s
43

Modelo de razonamiento actual

OpenAI - GPT Luna - 6 (max)

OpenAI GPT Luna 6 (max) en esta instantánea: Intelligence Index 38, contexto 1M, coste por tarea $0.07, mediana 129 tok/s y primer chunk 132.77s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
38
Coste por tarea
$0.07
Velocidad
129 tok/s
Primer chunk
132.77s
Respuesta total
136.65s
44

Modelo de razonamiento actual

OpenAI - GPT Terra - 5.6 (xhigh)

OpenAI GPT Terra 5.6 (xhigh) en esta instantánea: Intelligence Index 38, contexto 1M, coste por tarea $0.63, mediana 91 tok/s y primer chunk 28.50s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
38
Coste por tarea
$0.63
Velocidad
91 tok/s
Primer chunk
28.50s
Respuesta total
33.99s
45

Modelo de razonamiento actual

Xiaomi - MiMo - V2.6 Flash

Xiaomi MiMo V2.6 Flash en esta instantánea: Intelligence Index 38, contexto 1M, coste por tarea $0.06, mediana 50 tok/s y primer chunk 4.75s.

Ideal para: Agentes de código Xiaomi, trabajo de contexto largo y comparación por instantánea.

Xiaomi

Contexto
1M
Índice AA
38
Coste por tarea
$0.06
Velocidad
50 tok/s
Primer chunk
4.75s
Respuesta total
54.95s
46

Modelo de razonamiento actual

DeepSeek - DeepSeek - V4 Pro 0813 (max)

DeepSeek DeepSeek V4 Pro 0813 (max) en esta instantánea: Intelligence Index 36, contexto 1M, coste por tarea $0.67, mediana 109 tok/s y primer chunk 1.73s.

Ideal para: Agentes de código DeepSeek, trabajo de contexto largo y comparación por instantánea.

DeepSeek

Contexto
1M
Índice AA
36
Coste por tarea
$0.67
Velocidad
109 tok/s
Primer chunk
1.73s
Respuesta total
24.63s
47

Modelo de razonamiento actual

Anthropic - Claude Sonnet - 5.5 (low)

Anthropic Claude Sonnet 5.5 (low) en esta instantánea: Intelligence Index 36, contexto 1M, coste por tarea $0.42, mediana 100 tok/s y primer chunk 1.35s.

Ideal para: Agentes de código Anthropic, trabajo de contexto largo y comparación por instantánea.

Anthropic

Contexto
1M
Índice AA
36
Coste por tarea
$0.42
Velocidad
100 tok/s
Primer chunk
1.35s
Respuesta total
6.33s
48

Modelo de razonamiento actual

DeepSeek - DeepSeek - V4 Flash Vision (max)

DeepSeek DeepSeek V4 Flash Vision (max) en esta instantánea: Intelligence Index 35, contexto 1M, coste por tarea $0.31, mediana 219 tok/s y primer chunk 0.94s.

Ideal para: Agentes de código DeepSeek, trabajo de contexto largo y comparación por instantánea.

DeepSeek

Contexto
1M
Índice AA
35
Coste por tarea
$0.31
Velocidad
219 tok/s
Primer chunk
0.94s
Respuesta total
12.36s
49

Modelo de razonamiento actual

OpenAI - GPT Luna - 6 (xhigh)

OpenAI GPT Luna 6 (xhigh) en esta instantánea: Intelligence Index 35, contexto 1M, coste por tarea $0.04, mediana 138 tok/s y primer chunk 20.86s.

Ideal para: Agentes de código OpenAI, trabajo de contexto largo y comparación por instantánea.

OpenAI

Contexto
1M
Índice AA
35
Coste por tarea
$0.04
Velocidad
138 tok/s
Primer chunk
20.86s
Respuesta total
24.48s
50

Modelo de razonamiento actual

Z AI - GLM - 5.3 (low)

Z AI GLM 5.3 (low) en esta instantánea: Intelligence Index 34, contexto 1M, coste por tarea $0.85, mediana 69 tok/s y primer chunk 3.13s.

Ideal para: Agentes de código Z AI, trabajo de contexto largo y comparación por instantánea.

Z AI

Contexto
1M
Índice AA
34
Coste por tarea
$0.85
Velocidad
69 tok/s
Primer chunk
3.13s
Respuesta total
39.61s