AI Coding に戻る

AI モデルランキング

AI コーディングモデルランキング

Artificial Analysis Top 50。

スナップショット: 2026-10-03 ・ 最終確認: 2026-10-03

手法について

指標は Artificial Analysis の公開 LLM リーダーボードのある時点のスナップショットに基づきます。Intelligence Index、タスク単価、速度はスナップショット時点のベンチマーク結果です。プロバイダーの価格・提供状況・順位は頻繁に変わり、ベンチマークが高くても特定のコードベースや作業に最適とは限りません。

ソース
Artificial Analysis
最終確認
2026-10-03

Top 50 モデル

01

現行推論モデル

Anthropic - Claude Opus - 5.5 (max)

Claude Opus 5.5 max が Intelligence Index 58 で首位。1M コンテキスト、タスク単価 $5.98。中央値 93 tok/s、初回 689.18s。

適した用途: 短い初回より最上位の Intelligence Index を優先する、最大努力の Claude Opus 作業向け。

Anthropic

コンテキスト
1M
AA Index
58
タスク単価
$5.98
速度
93 tok/s
最初のチャンク
689.18s
総応答
694.56s
02

現行推論モデル

Anthropic - Claude Sonnet - 5.5 (max)

Claude Sonnet 5.5 max は 2 位。Intelligence Index 56、1M コンテキスト。タスク単価 $7.67 はトップ10で最高。初回 428.36s。

適した用途: タスク単価と待ち時間より Intelligence Index を優先する、最大努力の Claude Sonnet 作業向け。

Anthropic

コンテキスト
1M
AA Index
56
タスク単価
$7.67
速度
139 tok/s
最初のチャンク
428.36s
総応答
431.95s
03

現行推論モデル

Anthropic - Claude Opus - 5.5 (xhigh)

Claude Opus 5.5 xhigh は Sonnet 5.5 max と同じ Intelligence Index 56。1M コンテキスト、タスク単価 $3.46。初回 140.81s は Sonnet 5.5 max より短い。

適した用途: Sonnet 5.5 max と同じ Intelligence Index を、より低いタスク単価で使う高努力 Opus 5.5 coding 向け。

Anthropic

コンテキスト
1M
AA Index
56
タスク単価
$3.46
速度
83 tok/s
最初のチャンク
140.81s
総応答
146.82s
04

現行推論モデル

Anthropic - Claude Opus - 5.5 (high)

Claude Opus 5.5 high は 4 位。Intelligence Index 54、1M コンテキスト。タスク単価 $1.82、初回 37.37s は Opus 5.5 xhigh より短い。

適した用途: xhigh 級の初回待ちなしで高い Intelligence Index が必要な Claude Opus 5.5 coding 向け。

Anthropic

コンテキスト
1M
AA Index
54
タスク単価
$1.82
速度
80 tok/s
最初のチャンク
37.37s
総応答
43.64s
05

現行推論モデル

Anthropic - Claude Fable - 5.1 (max)

Claude Fable 5.1 max は 5 位。Intelligence Index 53、1M コンテキスト。タスク単価 $7.63 は Sonnet 5.5 max の次。初回 186.52s。

適した用途: タスク単価と待ち時間より Intelligence Index を優先する、最大努力の Claude Fable 作業向け。

Anthropic

コンテキスト
1M
AA Index
53
タスク単価
$7.63
速度
67 tok/s
最初のチャンク
186.52s
総応答
193.93s
06

現行推論モデル

Anthropic - Claude Fable - 5.1 (xhigh)

Claude Fable 5.1 xhigh は Intelligence Index 53 のまま、Fable 5.1 max と同点。1M コンテキスト、タスク単価 $5.98。初回 96.75s は Fable 5.1 max より短い。

適した用途: max のタスク単価は高いが、同じ Intelligence Index が欲しい高努力 Fable 5.1 coding 向け。

Anthropic

コンテキスト
1M
AA Index
53
タスク単価
$5.98
速度
66 tok/s
最初のチャンク
96.75s
総応答
104.30s
07

現行推論モデル

OpenAI - GPT Astra - 6 (max)

GPT-6 Astra max は 7 位。Intelligence Index 53、1M コンテキスト。タスク単価 $3.26 は Fable 5.1 max より低い。初回 319.00s。

適した用途: 非常に長い初回待ちを許容できる、OpenAI 中心のフロンティア agent 向け。

OpenAI

コンテキスト
1M
AA Index
53
タスク単価
$3.26
速度
54 tok/s
最初のチャンク
319.00s
総応答
328.32s
08

現行モデル、一部指標のみ

Google - Gemini - 4 Argon (high)

Gemini 4 Argon high は 8 位。Intelligence Index 53 で複数モデルと同点。1M コンテキスト、タスク単価 $1.99。速度とレイテンシはまだ未公開。

適した用途: 公開済みの速度より Intelligence Index を優先する Google のフロンティア coding 向け。

Google

コンテキスト
1M
AA Index
53
タスク単価
$1.99
速度
— tok/s
最初のチャンク
—
総応答
—
09

現行推論モデル

OpenAI - GPT Astra - 6 (xhigh)

GPT-6 Astra xhigh は 9 位。Intelligence Index 52、1M コンテキスト、タスク単価 $2.31。初回 144.37s は Astra max より短い。

適した用途: max より低いタスク単価で、Astra max に近い品質が欲しい OpenAI coding agent 向け。

OpenAI

コンテキスト
1M
AA Index
52
タスク単価
$2.31
速度
49 tok/s
最初のチャンク
144.37s
総応答
154.50s
10

現行推論モデル

Anthropic - Claude Sonnet - 5.5 (xhigh)

Claude Sonnet 5.5 xhigh は 10 位。Intelligence Index 52、1M コンテキスト。タスク単価 $2.75、中央値 104 tok/s、初回 33.63s は Sonnet 5.5 max より短い。

適した用途: max 級の初回待ちなしで高い Intelligence Index が必要な Claude Sonnet 5.5 coding 向け。

Anthropic

コンテキスト
1M
AA Index
52
タスク単価
$2.75
速度
104 tok/s
最初のチャンク
33.63s
総応答
38.45s
11

現行推論モデル

OpenAI - GPT Sol - 6.1 (max)

OpenAI GPT Sol 6.1 (max) はこのスナップショットで Intelligence Index 52、1M コンテキスト、タスク単価 $0.72、中央値 57 tok/s、初回 282.35s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
52
タスク単価
$0.72
速度
57 tok/s
最初のチャンク
282.35s
総応答
291.13s
12

現行推論モデル

Anthropic - Claude Opus - 5.5 (medium)

Anthropic Claude Opus 5.5 (medium) はこのスナップショットで Intelligence Index 51、1M コンテキスト、タスク単価 $1.34、中央値 73 tok/s、初回 25.24s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
51
タスク単価
$1.34
速度
73 tok/s
最初のチャンク
25.24s
総応答
32.06s
13

現行推論モデル

Anthropic - Claude Fable - 5.1 (high)

Anthropic Claude Fable 5.1 (high) はこのスナップショットで Intelligence Index 51、1M コンテキスト、タスク単価 $3.91、中央値 56 tok/s、初回 25.00s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
51
タスク単価
$3.91
速度
56 tok/s
最初のチャンク
25.00s
総応答
33.93s
14

現行推論モデル

OpenAI - GPT Sol - 6.1 (xhigh)

OpenAI GPT Sol 6.1 (xhigh) はこのスナップショットで Intelligence Index 51、1M コンテキスト、タスク単価 $0.39、中央値 51 tok/s、初回 128.47s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
51
タスク単価
$0.39
速度
51 tok/s
最初のチャンク
128.47s
総応答
138.37s
15

現行推論モデル

OpenAI - GPT Astra - 6 (high)

OpenAI GPT Astra 6 (high) はこのスナップショットで Intelligence Index 51、1M コンテキスト、タスク単価 $1.73、中央値 48 tok/s、初回 65.56s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
51
タスク単価
$1.73
速度
48 tok/s
最初のチャンク
65.56s
総応答
76.04s
16

現行推論モデル

OpenAI - GPT Sol - 6.1 (high)

OpenAI GPT Sol 6.1 (high) はこのスナップショットで Intelligence Index 50、1M コンテキスト、タスク単価 $0.32、中央値 50 tok/s、初回 57.71s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
50
タスク単価
$0.32
速度
50 tok/s
最初のチャンク
57.71s
総応答
67.64s
17

現行推論モデル

OpenAI - GPT Astra - 6 (medium)

OpenAI GPT Astra 6 (medium) はこのスナップショットで Intelligence Index 50、1M コンテキスト、タスク単価 $1.54、中央値 46 tok/s、初回 4.70s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
50
タスク単価
$1.54
速度
46 tok/s
最初のチャンク
4.70s
総応答
15.65s
18

現行推論モデル

Anthropic - Claude Fable - 5.1 (medium)

Anthropic Claude Fable 5.1 (medium) はこのスナップショットで Intelligence Index 49、1M コンテキスト、タスク単価 $2.98、中央値 57 tok/s、初回 9.11s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
49
タスク単価
$2.98
速度
57 tok/s
最初のチャンク
9.11s
総応答
17.85s
19

現行推論モデル

Meta - Muse Spark - 1.3 (max)

Meta Muse Spark 1.3 (max) はこのスナップショットで Intelligence Index 48、1M コンテキスト、タスク単価 $1.60、中央値 135 tok/s、初回 52.46s。

適した用途: Meta の coding agent、長文脈作業、スナップショット比較向け。

Meta

コンテキスト
1M
AA Index
48
タスク単価
$1.60
速度
135 tok/s
最初のチャンク
52.46s
総応答
71.04s
20

現行推論モデル

OpenAI - GPT Sol - 6.1 (medium)

OpenAI GPT Sol 6.1 (medium) はこのスナップショットで Intelligence Index 48、1M コンテキスト、タスク単価 $0.21、中央値 45 tok/s、初回 5.29s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
48
タスク単価
$0.21
速度
45 tok/s
最初のチャンク
5.29s
総応答
16.30s
21

現行推論モデル

Anthropic - Claude Fable - 5.1 (low)

Anthropic Claude Fable 5.1 (low) はこのスナップショットで Intelligence Index 47、1M コンテキスト、タスク単価 $2.37、中央値 55 tok/s、初回 4.73s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
47
タスク単価
$2.37
速度
55 tok/s
最初のチャンク
4.73s
総応答
13.80s
22

現行推論モデル

Anthropic - Claude Sonnet - 5.5 (high)

Anthropic Claude Sonnet 5.5 (high) はこのスナップショットで Intelligence Index 47、1M コンテキスト、タスク単価 $1.12、中央値 102 tok/s、初回 12.19s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
47
タスク単価
$1.12
速度
102 tok/s
最初のチャンク
12.19s
総応答
17.09s
23

現行推論モデル

SpaceXAI - Grok - 4.7 (xhigh)

SpaceXAI Grok 4.7 (xhigh) はこのスナップショットで Intelligence Index 46、500k コンテキスト、タスク単価 $3.74、中央値 79 tok/s、初回 41.26s。

適した用途: SpaceXAI の coding agent、長文脈作業、スナップショット比較向け。

SpaceXAI

コンテキスト
500k
AA Index
46
タスク単価
$3.74
速度
79 tok/s
最初のチャンク
41.26s
総応答
47.59s
24

現行推論モデル

SpaceXAI - Grok - 4.7 (high)

SpaceXAI Grok 4.7 (high) はこのスナップショットで Intelligence Index 46、500k コンテキスト、タスク単価 $2.73、中央値 78 tok/s、初回 33.12s。

適した用途: SpaceXAI の coding agent、長文脈作業、スナップショット比較向け。

SpaceXAI

コンテキスト
500k
AA Index
46
タスク単価
$2.73
速度
78 tok/s
最初のチャンク
33.12s
総応答
39.49s
25

現行推論モデル

Xiaomi - MiMo - V2.6 Pro

Xiaomi MiMo V2.6 Pro はこのスナップショットで Intelligence Index 46、1M コンテキスト、タスク単価 $0.13、中央値 45 tok/s、初回 3.82s。

適した用途: Xiaomi の coding agent、長文脈作業、スナップショット比較向け。

Xiaomi

コンテキスト
1M
AA Index
46
タスク単価
$0.13
速度
45 tok/s
最初のチャンク
3.82s
総応答
59.44s
26

現行推論モデル

OpenAI - GPT Astra - 6 (low)

OpenAI GPT Astra 6 (low) はこのスナップショットで Intelligence Index 46、1M コンテキスト、タスク単価 $0.82、中央値 47 tok/s、初回 2.75s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
46
タスク単価
$0.82
速度
47 tok/s
最初のチャンク
2.75s
総応答
13.34s
27

現行推論モデル

Alibaba - Qwen - 3.8 Max (0902)

Alibaba Qwen 3.8 Max (0902) はこのスナップショットで Intelligence Index 45、984k コンテキスト、タスク単価 $5.41、中央値 38 tok/s、初回 2.67s。

適した用途: Alibaba の coding agent、長文脈作業、スナップショット比較向け。

Alibaba

コンテキスト
984k
AA Index
45
タスク単価
$5.41
速度
38 tok/s
最初のチャンク
2.67s
総応答
68.62s
28

現行推論モデル

Meta - Muse Spark - 1.3 (xhigh)

Meta Muse Spark 1.3 (xhigh) はこのスナップショットで Intelligence Index 45、1M コンテキスト、タスク単価 $1.37、中央値 146 tok/s、初回 41.50s。

適した用途: Meta の coding agent、長文脈作業、スナップショット比較向け。

Meta

コンテキスト
1M
AA Index
45
タスク単価
$1.37
速度
146 tok/s
最初のチャンク
41.50s
総応答
58.68s
29

現行推論モデル

Z AI - GLM - 5.3 (max)

Z AI GLM 5.3 (max) はこのスナップショットで Intelligence Index 45、1M コンテキスト、タスク単価 $2.01、中央値 74 tok/s、初回 3.18s。

適した用途: Z AI の coding agent、長文脈作業、スナップショット比較向け。

Z AI

コンテキスト
1M
AA Index
45
タスク単価
$2.01
速度
74 tok/s
最初のチャンク
3.18s
総応答
36.90s
30

現行推論モデル

StepFun - Step - 5 Preview

StepFun Step 5 Preview はこのスナップショットで Intelligence Index 44、1M コンテキスト、タスク単価 $0.72、中央値 85 tok/s、初回 3.03s。

適した用途: StepFun の coding agent、長文脈作業、スナップショット比較向け。

StepFun

コンテキスト
1M
AA Index
44
タスク単価
$0.72
速度
85 tok/s
最初のチャンク
3.03s
総応答
32.40s
31

現行推論モデル

Kimi - Kimi - K3 (max)

Kimi Kimi K3 (max) はこのスナップショットで Intelligence Index 44、1.05M コンテキスト、タスク単価 $2.00、中央値 36 tok/s、初回 4.12s。

適した用途: Kimi の coding agent、長文脈作業、スナップショット比較向け。

Kimi

コンテキスト
1.05M
AA Index
44
タスク単価
$2.00
速度
36 tok/s
最初のチャンク
4.12s
総応答
72.72s
32

現行推論モデル

Anthropic - Claude Opus - 5.5 (low)

Anthropic Claude Opus 5.5 (low) はこのスナップショットで Intelligence Index 42、1M コンテキスト、タスク単価 $0.55、中央値 80 tok/s、初回 9.94s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
42
タスク単価
$0.55
速度
80 tok/s
最初のチャンク
9.94s
総応答
16.18s
33

現行推論モデル

SpaceXAI - Grok - 4.7 (low)

SpaceXAI Grok 4.7 (low) はこのスナップショットで Intelligence Index 42、500k コンテキスト、タスク単価 $1.25、中央値 75 tok/s、初回 8.62s。

適した用途: SpaceXAI の coding agent、長文脈作業、スナップショット比較向け。

SpaceXAI

コンテキスト
500k
AA Index
42
タスク単価
$1.25
速度
75 tok/s
最初のチャンク
8.62s
総応答
15.25s
34

現行推論モデル

OpenAI - GPT Sol - 6.1 (low)

OpenAI GPT Sol 6.1 (low) はこのスナップショットで Intelligence Index 42、1M コンテキスト、タスク単価 $0.13、中央値 48 tok/s、初回 3.37s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
42
タスク単価
$0.13
速度
48 tok/s
最初のチャンク
3.37s
総応答
13.78s
35

現行推論モデル

OpenAI - GPT Terra - 5.6 (max)

OpenAI GPT Terra 5.6 (max) はこのスナップショットで Intelligence Index 42、1M コンテキスト、タスク単価 $1.40、中央値 102 tok/s、初回 172.37s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
42
タスク単価
$1.40
速度
102 tok/s
最初のチャンク
172.37s
総応答
177.28s
36

現行推論モデル

Z AI - GLM - 5.3 Flash

Z AI GLM 5.3 Flash はこのスナップショットで Intelligence Index 42、1M コンテキスト、タスク単価 $0.25、中央値 53 tok/s、初回 3.29s。

適した用途: Z AI の coding agent、長文脈作業、スナップショット比較向け。

Z AI

コンテキスト
1M
AA Index
42
タスク単価
$0.25
速度
53 tok/s
最初のチャンク
3.29s
総応答
50.21s
37

現行推論モデル

Google - Gemini - 3.8 Flash (high)

Google Gemini 3.8 Flash (high) はこのスナップショットで Intelligence Index 41、1M コンテキスト、タスク単価 $1.24、中央値 242 tok/s、初回 16.13s。

適した用途: Google の coding agent、長文脈作業、スナップショット比較向け。

Google

コンテキスト
1M
AA Index
41
タスク単価
$1.24
速度
242 tok/s
最初のチャンク
16.13s
総応答
18.19s
38

現行推論モデル

Anthropic - Claude Sonnet - 5.5 (medium)

Anthropic Claude Sonnet 5.5 (medium) はこのスナップショットで Intelligence Index 41、1M コンテキスト、タスク単価 $0.59、中央値 107 tok/s、初回 1.21s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
41
タスク単価
$0.59
速度
107 tok/s
最初のチャンク
1.21s
総応答
5.88s
39

現行推論モデル

Alibaba - Qwen - 3.8 2.4T A95B

Alibaba Qwen 3.8 2.4T A95B はこのスナップショットで Intelligence Index 40、262k コンテキスト、タスク単価 $2.16、中央値 39 tok/s、初回 2.78s。

適した用途: Alibaba の coding agent、長文脈作業、スナップショット比較向け。

Alibaba

コンテキスト
262k
AA Index
40
タスク単価
$2.16
速度
39 tok/s
最初のチャンク
2.78s
総応答
66.94s
40

現行推論モデル

Alibaba - Qwen - 3.8 Flash Next

Alibaba Qwen 3.8 Flash Next はこのスナップショットで Intelligence Index 40、256k コンテキスト、タスク単価 $0.37、中央値 54 tok/s、初回 2.45s。

適した用途: Alibaba の coding agent、長文脈作業、スナップショット比較向け。

Alibaba

コンテキスト
256k
AA Index
40
タスク単価
$0.37
速度
54 tok/s
最初のチャンク
2.45s
総応答
48.98s
41

現行モデル、一部指標のみ

Google - Gemini - 3.8 Flash (medium)

Google Gemini 3.8 Flash (medium) はこのスナップショットで Intelligence Index 40、1M コンテキスト、タスク単価 $0.93。速度とレイテンシはまだ未公開。

適した用途: Google の coding agent、長文脈作業、スナップショット比較向け。

Google

コンテキスト
1M
AA Index
40
タスク単価
$0.93
速度
— tok/s
最初のチャンク
—
総応答
—
42

現行推論モデル

DeepSeek - DeepSeek - V4.1 Flash (max)

DeepSeek DeepSeek V4.1 Flash (max) はこのスナップショットで Intelligence Index 39、1M コンテキスト、タスク単価 $0.27、中央値 224 tok/s、初回 1.02s。

適した用途: DeepSeek の coding agent、長文脈作業、スナップショット比較向け。

DeepSeek

コンテキスト
1M
AA Index
39
タスク単価
$0.27
速度
224 tok/s
最初のチャンク
1.02s
総応答
12.21s
43

現行推論モデル

OpenAI - GPT Luna - 6 (max)

OpenAI GPT Luna 6 (max) はこのスナップショットで Intelligence Index 38、1M コンテキスト、タスク単価 $0.07、中央値 129 tok/s、初回 132.77s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
38
タスク単価
$0.07
速度
129 tok/s
最初のチャンク
132.77s
総応答
136.65s
44

現行推論モデル

OpenAI - GPT Terra - 5.6 (xhigh)

OpenAI GPT Terra 5.6 (xhigh) はこのスナップショットで Intelligence Index 38、1M コンテキスト、タスク単価 $0.63、中央値 91 tok/s、初回 28.50s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
38
タスク単価
$0.63
速度
91 tok/s
最初のチャンク
28.50s
総応答
33.99s
45

現行推論モデル

Xiaomi - MiMo - V2.6 Flash

Xiaomi MiMo V2.6 Flash はこのスナップショットで Intelligence Index 38、1M コンテキスト、タスク単価 $0.06、中央値 50 tok/s、初回 4.75s。

適した用途: Xiaomi の coding agent、長文脈作業、スナップショット比較向け。

Xiaomi

コンテキスト
1M
AA Index
38
タスク単価
$0.06
速度
50 tok/s
最初のチャンク
4.75s
総応答
54.95s
46

現行推論モデル

DeepSeek - DeepSeek - V4 Pro 0813 (max)

DeepSeek DeepSeek V4 Pro 0813 (max) はこのスナップショットで Intelligence Index 36、1M コンテキスト、タスク単価 $0.67、中央値 109 tok/s、初回 1.73s。

適した用途: DeepSeek の coding agent、長文脈作業、スナップショット比較向け。

DeepSeek

コンテキスト
1M
AA Index
36
タスク単価
$0.67
速度
109 tok/s
最初のチャンク
1.73s
総応答
24.63s
47

現行推論モデル

Anthropic - Claude Sonnet - 5.5 (low)

Anthropic Claude Sonnet 5.5 (low) はこのスナップショットで Intelligence Index 36、1M コンテキスト、タスク単価 $0.42、中央値 100 tok/s、初回 1.35s。

適した用途: Anthropic の coding agent、長文脈作業、スナップショット比較向け。

Anthropic

コンテキスト
1M
AA Index
36
タスク単価
$0.42
速度
100 tok/s
最初のチャンク
1.35s
総応答
6.33s
48

現行推論モデル

DeepSeek - DeepSeek - V4 Flash Vision (max)

DeepSeek DeepSeek V4 Flash Vision (max) はこのスナップショットで Intelligence Index 35、1M コンテキスト、タスク単価 $0.31、中央値 219 tok/s、初回 0.94s。

適した用途: DeepSeek の coding agent、長文脈作業、スナップショット比較向け。

DeepSeek

コンテキスト
1M
AA Index
35
タスク単価
$0.31
速度
219 tok/s
最初のチャンク
0.94s
総応答
12.36s
49

現行推論モデル

OpenAI - GPT Luna - 6 (xhigh)

OpenAI GPT Luna 6 (xhigh) はこのスナップショットで Intelligence Index 35、1M コンテキスト、タスク単価 $0.04、中央値 138 tok/s、初回 20.86s。

適した用途: OpenAI の coding agent、長文脈作業、スナップショット比較向け。

OpenAI

コンテキスト
1M
AA Index
35
タスク単価
$0.04
速度
138 tok/s
最初のチャンク
20.86s
総応答
24.48s
50

現行推論モデル

Z AI - GLM - 5.3 (low)

Z AI GLM 5.3 (low) はこのスナップショットで Intelligence Index 34、1M コンテキスト、タスク単価 $0.85、中央値 69 tok/s、初回 3.13s。

適した用途: Z AI の coding agent、長文脈作業、スナップショット比較向け。

Z AI

コンテキスト
1M
AA Index
34
タスク単価
$0.85
速度
69 tok/s
最初のチャンク
3.13s
総応答
39.61s