Voltar para AI Coding

Ranking de modelos de AI

Ranking de modelos de AI para código

Top 50 da Artificial Analysis.

Snapshot: 2026-10-03 · Última revisão: 2026-10-03

Metodologia

As métricas seguem um snapshot do leaderboard público de LLMs da Artificial Analysis: Índice de Inteligência, custo por tarefa e velocidade refletem o desempenho em benchmark na data do snapshot. Preço, disponibilidade e posições dos provedores mudam com frequência, e uma pontuação alta em benchmark não garante o melhor resultado para um codebase ou fluxo específico.

Fonte
Artificial Analysis
Última revisão
2026-10-03

Top 50 modelos

01

Modelo de raciocinio atual

Anthropic - Claude Opus - 5.5 (max)

Claude Opus 5.5 max lidera este snapshot com Intelligence Index 58, contexto de 1M e custo por tarefa $5.98. A mediana é 93 tok/s e o primeiro chunk é 689.18s.

Melhor para: Trabalho Claude Opus de máximo esforço quando o índice do topo importa mais que um primeiro chunk curto.

Anthropic

Contexto
1M
Índice AA
58
Custo por tarefa
$5.98
Velocidade
93 tok/s
Primeiro chunk
689.18s
Resposta total
694.56s
02

Modelo de raciocinio atual

Anthropic - Claude Sonnet - 5.5 (max)

Claude Sonnet 5.5 max fica em #2 com Intelligence Index 56 e contexto de 1M. O custo por tarefa é $7.67, o mais alto do top 10, e o primeiro chunk é 428.36s.

Melhor para: Trabalho Claude Sonnet de máximo esforço quando o índice importa mais que custo e tempo de espera.

Anthropic

Contexto
1M
Índice AA
56
Custo por tarefa
$7.67
Velocidade
139 tok/s
Primeiro chunk
428.36s
Resposta total
431.95s
03

Modelo de raciocinio atual

Anthropic - Claude Opus - 5.5 (xhigh)

Claude Opus 5.5 xhigh empata com Sonnet 5.5 max no Intelligence Index 56, com contexto de 1M e custo por tarefa $3.46. O primeiro chunk é 140.81s, menor que Sonnet 5.5 max.

Melhor para: Coding Opus 5.5 de alto esforço quando o índice deve igualar Sonnet 5.5 max com custo menor.

Anthropic

Contexto
1M
Índice AA
56
Custo por tarefa
$3.46
Velocidade
83 tok/s
Primeiro chunk
140.81s
Resposta total
146.82s
04

Modelo de raciocinio atual

Anthropic - Claude Opus - 5.5 (high)

Claude Opus 5.5 high fica em #4 com Intelligence Index 54 e contexto de 1M. O custo por tarefa é $1.82 e o primeiro chunk é 37.37s, bem abaixo de Opus 5.5 xhigh.

Melhor para: Coding Claude Opus 5.5 que ainda precisa de índice alto sem a espera do tier xhigh.

Anthropic

Contexto
1M
Índice AA
54
Custo por tarefa
$1.82
Velocidade
80 tok/s
Primeiro chunk
37.37s
Resposta total
43.64s
05

Modelo de raciocinio atual

Anthropic - Claude Fable - 5.1 (max)

Claude Fable 5.1 max fica em #5 com Intelligence Index 53 e contexto de 1M. O custo por tarefa é $7.63, logo abaixo de Sonnet 5.5 max, e o primeiro chunk é 186.52s.

Melhor para: Trabalho Claude Fable de máximo esforço quando o índice importa mais que custo e tempo de espera.

Anthropic

Contexto
1M
Índice AA
53
Custo por tarefa
$7.63
Velocidade
67 tok/s
Primeiro chunk
186.52s
Resposta total
193.93s
06

Modelo de raciocinio atual

Anthropic - Claude Fable - 5.1 (xhigh)

Claude Fable 5.1 xhigh permanece no Intelligence Index 53, empatado com Fable 5.1 max, com contexto de 1M e custo por tarefa $5.98. O primeiro chunk é 96.75s, menor que Fable 5.1 max.

Melhor para: Coding Fable 5.1 de alto esforço quando o custo max é alto demais e o índice precisa permanecer o mesmo.

Anthropic

Contexto
1M
Índice AA
53
Custo por tarefa
$5.98
Velocidade
66 tok/s
Primeiro chunk
96.75s
Resposta total
104.30s
07

Modelo de raciocinio atual

OpenAI - GPT Astra - 6 (max)

GPT-6 Astra max fica em #7 com Intelligence Index 53 e contexto de 1M. O custo por tarefa é $3.26, abaixo de Fable 5.1 max, e o primeiro chunk é 319.00s.

Melhor para: Agentes de fronteira centrados na OpenAI que podem absorver uma espera muito longa no primeiro chunk.

OpenAI

Contexto
1M
Índice AA
53
Custo por tarefa
$3.26
Velocidade
54 tok/s
Primeiro chunk
319.00s
Resposta total
328.32s
08

Modelo atual; métricas parciais

Google - Gemini - 4 Argon (high)

Gemini 4 Argon high fica em #8 com Intelligence Index 53, empatado com vários modelos em 53, contexto de 1M e custo por tarefa $1.99. Velocidade e latência ainda não foram publicadas.

Melhor para: Coding de fronteira no Google quando o índice importa mais que a velocidade publicada.

Google

Contexto
1M
Índice AA
53
Custo por tarefa
$1.99
Velocidade
— tok/s
Primeiro chunk
—
Resposta total
—
09

Modelo de raciocinio atual

OpenAI - GPT Astra - 6 (xhigh)

GPT-6 Astra xhigh fica em #9 com Intelligence Index 52, contexto de 1M e custo por tarefa $2.31. O primeiro chunk é 144.37s, menor que Astra max.

Melhor para: Agentes de código OpenAI que precisam de qualidade Astra perto do max com custo menor.

OpenAI

Contexto
1M
Índice AA
52
Custo por tarefa
$2.31
Velocidade
49 tok/s
Primeiro chunk
144.37s
Resposta total
154.50s
10

Modelo de raciocinio atual

Anthropic - Claude Sonnet - 5.5 (xhigh)

Claude Sonnet 5.5 xhigh fica em #10 com Intelligence Index 52 e contexto de 1M. O custo por tarefa é $2.75, a mediana é 104 tok/s e o primeiro chunk é 33.63s, bem abaixo de Sonnet 5.5 max.

Melhor para: Coding Claude Sonnet 5.5 que ainda precisa de índice alto sem a espera do tier max.

Anthropic

Contexto
1M
Índice AA
52
Custo por tarefa
$2.75
Velocidade
104 tok/s
Primeiro chunk
33.63s
Resposta total
38.45s
11

Modelo de raciocinio atual

OpenAI - GPT Sol - 6.1 (max)

OpenAI GPT Sol 6.1 (max) neste snapshot: Intelligence Index 52, contexto 1M, custo por tarefa $0.72, mediana 57 tok/s e primeiro chunk 282.35s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
52
Custo por tarefa
$0.72
Velocidade
57 tok/s
Primeiro chunk
282.35s
Resposta total
291.13s
12

Modelo de raciocinio atual

Anthropic - Claude Opus - 5.5 (medium)

Anthropic Claude Opus 5.5 (medium) neste snapshot: Intelligence Index 51, contexto 1M, custo por tarefa $1.34, mediana 73 tok/s e primeiro chunk 25.24s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
51
Custo por tarefa
$1.34
Velocidade
73 tok/s
Primeiro chunk
25.24s
Resposta total
32.06s
13

Modelo de raciocinio atual

Anthropic - Claude Fable - 5.1 (high)

Anthropic Claude Fable 5.1 (high) neste snapshot: Intelligence Index 51, contexto 1M, custo por tarefa $3.91, mediana 56 tok/s e primeiro chunk 25.00s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
51
Custo por tarefa
$3.91
Velocidade
56 tok/s
Primeiro chunk
25.00s
Resposta total
33.93s
14

Modelo de raciocinio atual

OpenAI - GPT Sol - 6.1 (xhigh)

OpenAI GPT Sol 6.1 (xhigh) neste snapshot: Intelligence Index 51, contexto 1M, custo por tarefa $0.39, mediana 51 tok/s e primeiro chunk 128.47s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
51
Custo por tarefa
$0.39
Velocidade
51 tok/s
Primeiro chunk
128.47s
Resposta total
138.37s
15

Modelo de raciocinio atual

OpenAI - GPT Astra - 6 (high)

OpenAI GPT Astra 6 (high) neste snapshot: Intelligence Index 51, contexto 1M, custo por tarefa $1.73, mediana 48 tok/s e primeiro chunk 65.56s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
51
Custo por tarefa
$1.73
Velocidade
48 tok/s
Primeiro chunk
65.56s
Resposta total
76.04s
16

Modelo de raciocinio atual

OpenAI - GPT Sol - 6.1 (high)

OpenAI GPT Sol 6.1 (high) neste snapshot: Intelligence Index 50, contexto 1M, custo por tarefa $0.32, mediana 50 tok/s e primeiro chunk 57.71s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
50
Custo por tarefa
$0.32
Velocidade
50 tok/s
Primeiro chunk
57.71s
Resposta total
67.64s
17

Modelo de raciocinio atual

OpenAI - GPT Astra - 6 (medium)

OpenAI GPT Astra 6 (medium) neste snapshot: Intelligence Index 50, contexto 1M, custo por tarefa $1.54, mediana 46 tok/s e primeiro chunk 4.70s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
50
Custo por tarefa
$1.54
Velocidade
46 tok/s
Primeiro chunk
4.70s
Resposta total
15.65s
18

Modelo de raciocinio atual

Anthropic - Claude Fable - 5.1 (medium)

Anthropic Claude Fable 5.1 (medium) neste snapshot: Intelligence Index 49, contexto 1M, custo por tarefa $2.98, mediana 57 tok/s e primeiro chunk 9.11s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
49
Custo por tarefa
$2.98
Velocidade
57 tok/s
Primeiro chunk
9.11s
Resposta total
17.85s
19

Modelo de raciocinio atual

Meta - Muse Spark - 1.3 (max)

Meta Muse Spark 1.3 (max) neste snapshot: Intelligence Index 48, contexto 1M, custo por tarefa $1.60, mediana 135 tok/s e primeiro chunk 52.46s.

Melhor para: Agentes de código Meta, trabalho de contexto longo e comparação por snapshot.

Meta

Contexto
1M
Índice AA
48
Custo por tarefa
$1.60
Velocidade
135 tok/s
Primeiro chunk
52.46s
Resposta total
71.04s
20

Modelo de raciocinio atual

OpenAI - GPT Sol - 6.1 (medium)

OpenAI GPT Sol 6.1 (medium) neste snapshot: Intelligence Index 48, contexto 1M, custo por tarefa $0.21, mediana 45 tok/s e primeiro chunk 5.29s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
48
Custo por tarefa
$0.21
Velocidade
45 tok/s
Primeiro chunk
5.29s
Resposta total
16.30s
21

Modelo de raciocinio atual

Anthropic - Claude Fable - 5.1 (low)

Anthropic Claude Fable 5.1 (low) neste snapshot: Intelligence Index 47, contexto 1M, custo por tarefa $2.37, mediana 55 tok/s e primeiro chunk 4.73s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
47
Custo por tarefa
$2.37
Velocidade
55 tok/s
Primeiro chunk
4.73s
Resposta total
13.80s
22

Modelo de raciocinio atual

Anthropic - Claude Sonnet - 5.5 (high)

Anthropic Claude Sonnet 5.5 (high) neste snapshot: Intelligence Index 47, contexto 1M, custo por tarefa $1.12, mediana 102 tok/s e primeiro chunk 12.19s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
47
Custo por tarefa
$1.12
Velocidade
102 tok/s
Primeiro chunk
12.19s
Resposta total
17.09s
23

Modelo de raciocinio atual

SpaceXAI - Grok - 4.7 (xhigh)

SpaceXAI Grok 4.7 (xhigh) neste snapshot: Intelligence Index 46, contexto 500k, custo por tarefa $3.74, mediana 79 tok/s e primeiro chunk 41.26s.

Melhor para: Agentes de código SpaceXAI, trabalho de contexto longo e comparação por snapshot.

SpaceXAI

Contexto
500k
Índice AA
46
Custo por tarefa
$3.74
Velocidade
79 tok/s
Primeiro chunk
41.26s
Resposta total
47.59s
24

Modelo de raciocinio atual

SpaceXAI - Grok - 4.7 (high)

SpaceXAI Grok 4.7 (high) neste snapshot: Intelligence Index 46, contexto 500k, custo por tarefa $2.73, mediana 78 tok/s e primeiro chunk 33.12s.

Melhor para: Agentes de código SpaceXAI, trabalho de contexto longo e comparação por snapshot.

SpaceXAI

Contexto
500k
Índice AA
46
Custo por tarefa
$2.73
Velocidade
78 tok/s
Primeiro chunk
33.12s
Resposta total
39.49s
25

Modelo de raciocinio atual

Xiaomi - MiMo - V2.6 Pro

Xiaomi MiMo V2.6 Pro neste snapshot: Intelligence Index 46, contexto 1M, custo por tarefa $0.13, mediana 45 tok/s e primeiro chunk 3.82s.

Melhor para: Agentes de código Xiaomi, trabalho de contexto longo e comparação por snapshot.

Xiaomi

Contexto
1M
Índice AA
46
Custo por tarefa
$0.13
Velocidade
45 tok/s
Primeiro chunk
3.82s
Resposta total
59.44s
26

Modelo de raciocinio atual

OpenAI - GPT Astra - 6 (low)

OpenAI GPT Astra 6 (low) neste snapshot: Intelligence Index 46, contexto 1M, custo por tarefa $0.82, mediana 47 tok/s e primeiro chunk 2.75s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
46
Custo por tarefa
$0.82
Velocidade
47 tok/s
Primeiro chunk
2.75s
Resposta total
13.34s
27

Modelo de raciocinio atual

Alibaba - Qwen - 3.8 Max (0902)

Alibaba Qwen 3.8 Max (0902) neste snapshot: Intelligence Index 45, contexto 984k, custo por tarefa $5.41, mediana 38 tok/s e primeiro chunk 2.67s.

Melhor para: Agentes de código Alibaba, trabalho de contexto longo e comparação por snapshot.

Alibaba

Contexto
984k
Índice AA
45
Custo por tarefa
$5.41
Velocidade
38 tok/s
Primeiro chunk
2.67s
Resposta total
68.62s
28

Modelo de raciocinio atual

Meta - Muse Spark - 1.3 (xhigh)

Meta Muse Spark 1.3 (xhigh) neste snapshot: Intelligence Index 45, contexto 1M, custo por tarefa $1.37, mediana 146 tok/s e primeiro chunk 41.50s.

Melhor para: Agentes de código Meta, trabalho de contexto longo e comparação por snapshot.

Meta

Contexto
1M
Índice AA
45
Custo por tarefa
$1.37
Velocidade
146 tok/s
Primeiro chunk
41.50s
Resposta total
58.68s
29

Modelo de raciocinio atual

Z AI - GLM - 5.3 (max)

Z AI GLM 5.3 (max) neste snapshot: Intelligence Index 45, contexto 1M, custo por tarefa $2.01, mediana 74 tok/s e primeiro chunk 3.18s.

Melhor para: Agentes de código Z AI, trabalho de contexto longo e comparação por snapshot.

Z AI

Contexto
1M
Índice AA
45
Custo por tarefa
$2.01
Velocidade
74 tok/s
Primeiro chunk
3.18s
Resposta total
36.90s
30

Modelo de raciocinio atual

StepFun - Step - 5 Preview

StepFun Step 5 Preview neste snapshot: Intelligence Index 44, contexto 1M, custo por tarefa $0.72, mediana 85 tok/s e primeiro chunk 3.03s.

Melhor para: Agentes de código StepFun, trabalho de contexto longo e comparação por snapshot.

StepFun

Contexto
1M
Índice AA
44
Custo por tarefa
$0.72
Velocidade
85 tok/s
Primeiro chunk
3.03s
Resposta total
32.40s
31

Modelo de raciocinio atual

Kimi - Kimi - K3 (max)

Kimi Kimi K3 (max) neste snapshot: Intelligence Index 44, contexto 1.05M, custo por tarefa $2.00, mediana 36 tok/s e primeiro chunk 4.12s.

Melhor para: Agentes de código Kimi, trabalho de contexto longo e comparação por snapshot.

Kimi

Contexto
1.05M
Índice AA
44
Custo por tarefa
$2.00
Velocidade
36 tok/s
Primeiro chunk
4.12s
Resposta total
72.72s
32

Modelo de raciocinio atual

Anthropic - Claude Opus - 5.5 (low)

Anthropic Claude Opus 5.5 (low) neste snapshot: Intelligence Index 42, contexto 1M, custo por tarefa $0.55, mediana 80 tok/s e primeiro chunk 9.94s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
42
Custo por tarefa
$0.55
Velocidade
80 tok/s
Primeiro chunk
9.94s
Resposta total
16.18s
33

Modelo de raciocinio atual

SpaceXAI - Grok - 4.7 (low)

SpaceXAI Grok 4.7 (low) neste snapshot: Intelligence Index 42, contexto 500k, custo por tarefa $1.25, mediana 75 tok/s e primeiro chunk 8.62s.

Melhor para: Agentes de código SpaceXAI, trabalho de contexto longo e comparação por snapshot.

SpaceXAI

Contexto
500k
Índice AA
42
Custo por tarefa
$1.25
Velocidade
75 tok/s
Primeiro chunk
8.62s
Resposta total
15.25s
34

Modelo de raciocinio atual

OpenAI - GPT Sol - 6.1 (low)

OpenAI GPT Sol 6.1 (low) neste snapshot: Intelligence Index 42, contexto 1M, custo por tarefa $0.13, mediana 48 tok/s e primeiro chunk 3.37s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
42
Custo por tarefa
$0.13
Velocidade
48 tok/s
Primeiro chunk
3.37s
Resposta total
13.78s
35

Modelo de raciocinio atual

OpenAI - GPT Terra - 5.6 (max)

OpenAI GPT Terra 5.6 (max) neste snapshot: Intelligence Index 42, contexto 1M, custo por tarefa $1.40, mediana 102 tok/s e primeiro chunk 172.37s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
42
Custo por tarefa
$1.40
Velocidade
102 tok/s
Primeiro chunk
172.37s
Resposta total
177.28s
36

Modelo de raciocinio atual

Z AI - GLM - 5.3 Flash

Z AI GLM 5.3 Flash neste snapshot: Intelligence Index 42, contexto 1M, custo por tarefa $0.25, mediana 53 tok/s e primeiro chunk 3.29s.

Melhor para: Agentes de código Z AI, trabalho de contexto longo e comparação por snapshot.

Z AI

Contexto
1M
Índice AA
42
Custo por tarefa
$0.25
Velocidade
53 tok/s
Primeiro chunk
3.29s
Resposta total
50.21s
37

Modelo de raciocinio atual

Google - Gemini - 3.8 Flash (high)

Google Gemini 3.8 Flash (high) neste snapshot: Intelligence Index 41, contexto 1M, custo por tarefa $1.24, mediana 242 tok/s e primeiro chunk 16.13s.

Melhor para: Agentes de código Google, trabalho de contexto longo e comparação por snapshot.

Google

Contexto
1M
Índice AA
41
Custo por tarefa
$1.24
Velocidade
242 tok/s
Primeiro chunk
16.13s
Resposta total
18.19s
38

Modelo de raciocinio atual

Anthropic - Claude Sonnet - 5.5 (medium)

Anthropic Claude Sonnet 5.5 (medium) neste snapshot: Intelligence Index 41, contexto 1M, custo por tarefa $0.59, mediana 107 tok/s e primeiro chunk 1.21s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
41
Custo por tarefa
$0.59
Velocidade
107 tok/s
Primeiro chunk
1.21s
Resposta total
5.88s
39

Modelo de raciocinio atual

Alibaba - Qwen - 3.8 2.4T A95B

Alibaba Qwen 3.8 2.4T A95B neste snapshot: Intelligence Index 40, contexto 262k, custo por tarefa $2.16, mediana 39 tok/s e primeiro chunk 2.78s.

Melhor para: Agentes de código Alibaba, trabalho de contexto longo e comparação por snapshot.

Alibaba

Contexto
262k
Índice AA
40
Custo por tarefa
$2.16
Velocidade
39 tok/s
Primeiro chunk
2.78s
Resposta total
66.94s
40

Modelo de raciocinio atual

Alibaba - Qwen - 3.8 Flash Next

Alibaba Qwen 3.8 Flash Next neste snapshot: Intelligence Index 40, contexto 256k, custo por tarefa $0.37, mediana 54 tok/s e primeiro chunk 2.45s.

Melhor para: Agentes de código Alibaba, trabalho de contexto longo e comparação por snapshot.

Alibaba

Contexto
256k
Índice AA
40
Custo por tarefa
$0.37
Velocidade
54 tok/s
Primeiro chunk
2.45s
Resposta total
48.98s
41

Modelo atual; métricas parciais

Google - Gemini - 3.8 Flash (medium)

Google Gemini 3.8 Flash (medium) neste snapshot: Intelligence Index 40, contexto 1M e custo por tarefa $0.93. Velocidade e latência ainda não foram publicadas.

Melhor para: Agentes de código Google, trabalho de contexto longo e comparação por snapshot.

Google

Contexto
1M
Índice AA
40
Custo por tarefa
$0.93
Velocidade
— tok/s
Primeiro chunk
—
Resposta total
—
42

Modelo de raciocinio atual

DeepSeek - DeepSeek - V4.1 Flash (max)

DeepSeek DeepSeek V4.1 Flash (max) neste snapshot: Intelligence Index 39, contexto 1M, custo por tarefa $0.27, mediana 224 tok/s e primeiro chunk 1.02s.

Melhor para: Agentes de código DeepSeek, trabalho de contexto longo e comparação por snapshot.

DeepSeek

Contexto
1M
Índice AA
39
Custo por tarefa
$0.27
Velocidade
224 tok/s
Primeiro chunk
1.02s
Resposta total
12.21s
43

Modelo de raciocinio atual

OpenAI - GPT Luna - 6 (max)

OpenAI GPT Luna 6 (max) neste snapshot: Intelligence Index 38, contexto 1M, custo por tarefa $0.07, mediana 129 tok/s e primeiro chunk 132.77s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
38
Custo por tarefa
$0.07
Velocidade
129 tok/s
Primeiro chunk
132.77s
Resposta total
136.65s
44

Modelo de raciocinio atual

OpenAI - GPT Terra - 5.6 (xhigh)

OpenAI GPT Terra 5.6 (xhigh) neste snapshot: Intelligence Index 38, contexto 1M, custo por tarefa $0.63, mediana 91 tok/s e primeiro chunk 28.50s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
38
Custo por tarefa
$0.63
Velocidade
91 tok/s
Primeiro chunk
28.50s
Resposta total
33.99s
45

Modelo de raciocinio atual

Xiaomi - MiMo - V2.6 Flash

Xiaomi MiMo V2.6 Flash neste snapshot: Intelligence Index 38, contexto 1M, custo por tarefa $0.06, mediana 50 tok/s e primeiro chunk 4.75s.

Melhor para: Agentes de código Xiaomi, trabalho de contexto longo e comparação por snapshot.

Xiaomi

Contexto
1M
Índice AA
38
Custo por tarefa
$0.06
Velocidade
50 tok/s
Primeiro chunk
4.75s
Resposta total
54.95s
46

Modelo de raciocinio atual

DeepSeek - DeepSeek - V4 Pro 0813 (max)

DeepSeek DeepSeek V4 Pro 0813 (max) neste snapshot: Intelligence Index 36, contexto 1M, custo por tarefa $0.67, mediana 109 tok/s e primeiro chunk 1.73s.

Melhor para: Agentes de código DeepSeek, trabalho de contexto longo e comparação por snapshot.

DeepSeek

Contexto
1M
Índice AA
36
Custo por tarefa
$0.67
Velocidade
109 tok/s
Primeiro chunk
1.73s
Resposta total
24.63s
47

Modelo de raciocinio atual

Anthropic - Claude Sonnet - 5.5 (low)

Anthropic Claude Sonnet 5.5 (low) neste snapshot: Intelligence Index 36, contexto 1M, custo por tarefa $0.42, mediana 100 tok/s e primeiro chunk 1.35s.

Melhor para: Agentes de código Anthropic, trabalho de contexto longo e comparação por snapshot.

Anthropic

Contexto
1M
Índice AA
36
Custo por tarefa
$0.42
Velocidade
100 tok/s
Primeiro chunk
1.35s
Resposta total
6.33s
48

Modelo de raciocinio atual

DeepSeek - DeepSeek - V4 Flash Vision (max)

DeepSeek DeepSeek V4 Flash Vision (max) neste snapshot: Intelligence Index 35, contexto 1M, custo por tarefa $0.31, mediana 219 tok/s e primeiro chunk 0.94s.

Melhor para: Agentes de código DeepSeek, trabalho de contexto longo e comparação por snapshot.

DeepSeek

Contexto
1M
Índice AA
35
Custo por tarefa
$0.31
Velocidade
219 tok/s
Primeiro chunk
0.94s
Resposta total
12.36s
49

Modelo de raciocinio atual

OpenAI - GPT Luna - 6 (xhigh)

OpenAI GPT Luna 6 (xhigh) neste snapshot: Intelligence Index 35, contexto 1M, custo por tarefa $0.04, mediana 138 tok/s e primeiro chunk 20.86s.

Melhor para: Agentes de código OpenAI, trabalho de contexto longo e comparação por snapshot.

OpenAI

Contexto
1M
Índice AA
35
Custo por tarefa
$0.04
Velocidade
138 tok/s
Primeiro chunk
20.86s
Resposta total
24.48s
50

Modelo de raciocinio atual

Z AI - GLM - 5.3 (low)

Z AI GLM 5.3 (low) neste snapshot: Intelligence Index 34, contexto 1M, custo por tarefa $0.85, mediana 69 tok/s e primeiro chunk 3.13s.

Melhor para: Agentes de código Z AI, trabalho de contexto longo e comparação por snapshot.

Z AI

Contexto
1M
Índice AA
34
Custo por tarefa
$0.85
Velocidade
69 tok/s
Primeiro chunk
3.13s
Resposta total
39.61s