当前推理模型
Anthropic - Claude Opus - 5.5 (max)
Claude Opus 5.5 max 以智能指数 58 领跑本快照,1M 上下文,任务成本 $5.98。中位 93 tok/s,首块 689.18s。
适合场景: 适合更看重榜首智能指数、可以接受很长首块等待的最高力度 Claude Opus 任务。
Anthropic
- 上下文
- 1M
- AA 指数
- 58
- 任务成本
- $5.98
- 速度
- 93 tok/s
- 首块延迟
- 689.18s
- 总响应
- 694.56s
以下指标来自 Artificial Analysis 公开 LLM 榜单的某个快照:智能指数、任务成本与速度反映的是快照当天的跑分表现。厂商价格、可用性与排名会频繁变化,跑分高也不代表在你的具体代码库或工作流中就是最佳选择。
当前推理模型
Claude Opus 5.5 max 以智能指数 58 领跑本快照,1M 上下文,任务成本 $5.98。中位 93 tok/s,首块 689.18s。
适合场景: 适合更看重榜首智能指数、可以接受很长首块等待的最高力度 Claude Opus 任务。
Anthropic
当前推理模型
Claude Sonnet 5.5 max 位列第 2,智能指数 56,1M 上下文。任务成本 $7.67,是前十里最高的;首块 428.36s。
适合场景: 适合更看重智能指数、可以接受更高任务成本和较长等待的最高力度 Claude Sonnet 任务。
Anthropic
当前推理模型
Claude Opus 5.5 xhigh 与 Sonnet 5.5 max 同为智能指数 56,1M 上下文,任务成本 $3.46。首块 140.81s,短于 Sonnet 5.5 max。
适合场景: 适合要与 Sonnet 5.5 max 相同智能指数、又希望任务成本更低的高力度 Opus 5.5 编程。
Anthropic
当前推理模型
Claude Opus 5.5 high 位列第 4,智能指数 54,1M 上下文。任务成本 $1.82,首块 37.37s,远低于 Opus 5.5 xhigh。
适合场景: 适合仍需较高智能指数、又不想等 xhigh 档首块的 Claude Opus 5.5 编程。
Anthropic
当前推理模型
Claude Fable 5.1 max 位列第 5,智能指数 53,1M 上下文。任务成本 $7.63,仅次于 Sonnet 5.5 max;首块 186.52s。
适合场景: 适合更看重智能指数、可以接受较高任务成本和等待的最高力度 Claude Fable 任务。
Anthropic
当前推理模型
Claude Fable 5.1 xhigh 智能指数仍是 53,与 Fable 5.1 max 并列,1M 上下文,任务成本 $5.98。首块 96.75s,短于 Fable 5.1 max。
适合场景: 适合觉得 max 任务成本太高、但仍要相同智能指数的高力度 Fable 5.1 编程。
Anthropic
当前推理模型
GPT-6 Astra max 位列第 7,智能指数 53,1M 上下文。任务成本 $3.26,低于 Fable 5.1 max;首块 319.00s。
适合场景: 适合能接受很长首块等待的 OpenAI 前沿 agent。
OpenAI
当前模型;部分指标未公开
Gemini 4 Argon high 位列第 8,智能指数 53,与多款 53 分模型并列,1M 上下文,任务成本 $1.99。输出速度与延迟尚未公布。
适合场景: 适合更看重智能指数、可以接受速度尚未公开的 Google 前沿编程。
当前推理模型
GPT-6 Astra xhigh 位列第 9,智能指数 52,1M 上下文,任务成本 $2.31。首块 144.37s,短于 Astra max。
适合场景: 适合需要接近 max 的 Astra 质量、又希望任务成本更低的 OpenAI coding agent。
OpenAI
当前推理模型
Claude Sonnet 5.5 xhigh 位列第 10,智能指数 52,1M 上下文。任务成本 $2.75,中位 104 tok/s,首块 33.63s,远低于 Sonnet 5.5 max。
适合场景: 适合仍需较高智能指数、又不想等 max 档首块的 Claude Sonnet 5.5 编程。
Anthropic
当前推理模型
OpenAI GPT Sol 6.1 (max) 在本快照中智能指数 52,1M 上下文,任务成本 $0.72,中位 57 tok/s,首块 282.35s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Anthropic Claude Opus 5.5 (medium) 在本快照中智能指数 51,1M 上下文,任务成本 $1.34,中位 73 tok/s,首块 25.24s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
Anthropic Claude Fable 5.1 (high) 在本快照中智能指数 51,1M 上下文,任务成本 $3.91,中位 56 tok/s,首块 25.00s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
OpenAI GPT Sol 6.1 (xhigh) 在本快照中智能指数 51,1M 上下文,任务成本 $0.39,中位 51 tok/s,首块 128.47s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
OpenAI GPT Astra 6 (high) 在本快照中智能指数 51,1M 上下文,任务成本 $1.73,中位 48 tok/s,首块 65.56s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
OpenAI GPT Sol 6.1 (high) 在本快照中智能指数 50,1M 上下文,任务成本 $0.32,中位 50 tok/s,首块 57.71s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
OpenAI GPT Astra 6 (medium) 在本快照中智能指数 50,1M 上下文,任务成本 $1.54,中位 46 tok/s,首块 4.70s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Anthropic Claude Fable 5.1 (medium) 在本快照中智能指数 49,1M 上下文,任务成本 $2.98,中位 57 tok/s,首块 9.11s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
Meta Muse Spark 1.3 (max) 在本快照中智能指数 48,1M 上下文,任务成本 $1.60,中位 135 tok/s,首块 52.46s。
适合场景: 适合 Meta coding agent、长上下文任务,以及按快照比较模型。
Meta
当前推理模型
OpenAI GPT Sol 6.1 (medium) 在本快照中智能指数 48,1M 上下文,任务成本 $0.21,中位 45 tok/s,首块 5.29s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Anthropic Claude Fable 5.1 (low) 在本快照中智能指数 47,1M 上下文,任务成本 $2.37,中位 55 tok/s,首块 4.73s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
Anthropic Claude Sonnet 5.5 (high) 在本快照中智能指数 47,1M 上下文,任务成本 $1.12,中位 102 tok/s,首块 12.19s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
SpaceXAI Grok 4.7 (xhigh) 在本快照中智能指数 46,500k 上下文,任务成本 $3.74,中位 79 tok/s,首块 41.26s。
适合场景: 适合 SpaceXAI coding agent、长上下文任务,以及按快照比较模型。
SpaceXAI
当前推理模型
SpaceXAI Grok 4.7 (high) 在本快照中智能指数 46,500k 上下文,任务成本 $2.73,中位 78 tok/s,首块 33.12s。
适合场景: 适合 SpaceXAI coding agent、长上下文任务,以及按快照比较模型。
SpaceXAI
当前推理模型
Xiaomi MiMo V2.6 Pro 在本快照中智能指数 46,1M 上下文,任务成本 $0.13,中位 45 tok/s,首块 3.82s。
适合场景: 适合 Xiaomi coding agent、长上下文任务,以及按快照比较模型。
Xiaomi
当前推理模型
OpenAI GPT Astra 6 (low) 在本快照中智能指数 46,1M 上下文,任务成本 $0.82,中位 47 tok/s,首块 2.75s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Alibaba Qwen 3.8 Max (0902) 在本快照中智能指数 45,984k 上下文,任务成本 $5.41,中位 38 tok/s,首块 2.67s。
适合场景: 适合 Alibaba coding agent、长上下文任务,以及按快照比较模型。
Alibaba
当前推理模型
Meta Muse Spark 1.3 (xhigh) 在本快照中智能指数 45,1M 上下文,任务成本 $1.37,中位 146 tok/s,首块 41.50s。
适合场景: 适合 Meta coding agent、长上下文任务,以及按快照比较模型。
Meta
当前推理模型
Z AI GLM 5.3 (max) 在本快照中智能指数 45,1M 上下文,任务成本 $2.01,中位 74 tok/s,首块 3.18s。
适合场景: 适合 Z AI coding agent、长上下文任务,以及按快照比较模型。
Z AI
当前推理模型
StepFun Step 5 Preview 在本快照中智能指数 44,1M 上下文,任务成本 $0.72,中位 85 tok/s,首块 3.03s。
适合场景: 适合 StepFun coding agent、长上下文任务,以及按快照比较模型。
StepFun
当前推理模型
Kimi Kimi K3 (max) 在本快照中智能指数 44,1.05M 上下文,任务成本 $2.00,中位 36 tok/s,首块 4.12s。
适合场景: 适合 Kimi coding agent、长上下文任务,以及按快照比较模型。
Kimi
当前推理模型
Anthropic Claude Opus 5.5 (low) 在本快照中智能指数 42,1M 上下文,任务成本 $0.55,中位 80 tok/s,首块 9.94s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
SpaceXAI Grok 4.7 (low) 在本快照中智能指数 42,500k 上下文,任务成本 $1.25,中位 75 tok/s,首块 8.62s。
适合场景: 适合 SpaceXAI coding agent、长上下文任务,以及按快照比较模型。
SpaceXAI
当前推理模型
OpenAI GPT Sol 6.1 (low) 在本快照中智能指数 42,1M 上下文,任务成本 $0.13,中位 48 tok/s,首块 3.37s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
OpenAI GPT Terra 5.6 (max) 在本快照中智能指数 42,1M 上下文,任务成本 $1.40,中位 102 tok/s,首块 172.37s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Z AI GLM 5.3 Flash 在本快照中智能指数 42,1M 上下文,任务成本 $0.25,中位 53 tok/s,首块 3.29s。
适合场景: 适合 Z AI coding agent、长上下文任务,以及按快照比较模型。
Z AI
当前推理模型
Google Gemini 3.8 Flash (high) 在本快照中智能指数 41,1M 上下文,任务成本 $1.24,中位 242 tok/s,首块 16.13s。
适合场景: 适合 Google coding agent、长上下文任务,以及按快照比较模型。
当前推理模型
Anthropic Claude Sonnet 5.5 (medium) 在本快照中智能指数 41,1M 上下文,任务成本 $0.59,中位 107 tok/s,首块 1.21s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
Alibaba Qwen 3.8 2.4T A95B 在本快照中智能指数 40,262k 上下文,任务成本 $2.16,中位 39 tok/s,首块 2.78s。
适合场景: 适合 Alibaba coding agent、长上下文任务,以及按快照比较模型。
Alibaba
当前推理模型
Alibaba Qwen 3.8 Flash Next 在本快照中智能指数 40,256k 上下文,任务成本 $0.37,中位 54 tok/s,首块 2.45s。
适合场景: 适合 Alibaba coding agent、长上下文任务,以及按快照比较模型。
Alibaba
当前模型;部分指标未公开
Google Gemini 3.8 Flash (medium) 在本快照中智能指数 40,1M 上下文,任务成本 $0.93。输出速度与延迟尚未公布。
适合场景: 适合 Google coding agent、长上下文任务,以及按快照比较模型。
当前推理模型
DeepSeek DeepSeek V4.1 Flash (max) 在本快照中智能指数 39,1M 上下文,任务成本 $0.27,中位 224 tok/s,首块 1.02s。
适合场景: 适合 DeepSeek coding agent、长上下文任务,以及按快照比较模型。
DeepSeek
当前推理模型
OpenAI GPT Luna 6 (max) 在本快照中智能指数 38,1M 上下文,任务成本 $0.07,中位 129 tok/s,首块 132.77s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
OpenAI GPT Terra 5.6 (xhigh) 在本快照中智能指数 38,1M 上下文,任务成本 $0.63,中位 91 tok/s,首块 28.50s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Xiaomi MiMo V2.6 Flash 在本快照中智能指数 38,1M 上下文,任务成本 $0.06,中位 50 tok/s,首块 4.75s。
适合场景: 适合 Xiaomi coding agent、长上下文任务,以及按快照比较模型。
Xiaomi
当前推理模型
DeepSeek DeepSeek V4 Pro 0813 (max) 在本快照中智能指数 36,1M 上下文,任务成本 $0.67,中位 109 tok/s,首块 1.73s。
适合场景: 适合 DeepSeek coding agent、长上下文任务,以及按快照比较模型。
DeepSeek
当前推理模型
Anthropic Claude Sonnet 5.5 (low) 在本快照中智能指数 36,1M 上下文,任务成本 $0.42,中位 100 tok/s,首块 1.35s。
适合场景: 适合 Anthropic coding agent、长上下文任务,以及按快照比较模型。
Anthropic
当前推理模型
DeepSeek DeepSeek V4 Flash Vision (max) 在本快照中智能指数 35,1M 上下文,任务成本 $0.31,中位 219 tok/s,首块 0.94s。
适合场景: 适合 DeepSeek coding agent、长上下文任务,以及按快照比较模型。
DeepSeek
当前推理模型
OpenAI GPT Luna 6 (xhigh) 在本快照中智能指数 35,1M 上下文,任务成本 $0.04,中位 138 tok/s,首块 20.86s。
适合场景: 适合 OpenAI coding agent、长上下文任务,以及按快照比较模型。
OpenAI
当前推理模型
Z AI GLM 5.3 (low) 在本快照中智能指数 34,1M 上下文,任务成本 $0.85,中位 69 tok/s,首块 3.13s。
适合场景: 适合 Z AI coding agent、长上下文任务,以及按快照比较模型。
Z AI