Claude Opus 5 でコードを書く:ティア・レイテンシ・下げどき
Opus 5 は単一モデルではなくティアの階段です。DevCove 2026-07-25 スナップショットで max / high / medium をリポジに合わせ、オートコンプリート作業に max 料金を払うのをやめましょう。
先四半期、誰かが社内メモをスライドに貼りました。「デフォルト Opus 5 max — Artificial Analysis で rank #1」 と。財務が行項目に気づくより先に、エンジニアリングはレイテンシに気づきませんでした。Anthropic が出したのは Opus 5 一本ではなく、max / xhigh / high / medium / low という 階段 です。同じ公開リーダーボードでも、ティアごとに ファーストチャンクの遅延とタスク単価 が違います。
この記事は、Claude Code や API でデフォルトモデルを選ぶ人向けです。数値は DevCove 2026-07-25 の AI コーディングモデルランキング スナップショット(Artificial Analysis 由来)です。変わり得ます。スライドに写す前に、ランキングページの日付を必ず確認してください。
頭の中のモデルが壊れたところ
Intelligence Index を CPU の GHz のように扱っていました。高いほど常にコーディング向き、と。Opus 5 max はスナップショットで 61 で首位ですが、ベンチハーネスでは ファーストチャンク約 64s。Opus 5 medium は 56 で 約 5.6s です。IDE で待つ人にとって、その差が製品そのもので、脚注ではありません。
| よくある誤り | 実際に起きること |
|---|---|
| リファクタ全部 max | 同じテストなら medium で通る diff に最上位ティア代を払う |
| クロスサービス移行を medium | モデル代は安いが、計画が薄いと人手修復で戻す |
| 調達でティアを無視 | 一つの SKU 名の裏に、五種類のレイテンシ請求 |
スナップショットの読み方: Index は ベンチタスク の順位であり、あなたのモノレポではありません。表と ship checklist 付きの限定トライアルをセットで。
ティア階段(2026-07-25 スナップショット)
生の方法論は Artificial Analysis を参照。DevCove が Opus 5 SKU について保持するフィールド:
| Tier | Rank | Index | Cost / task | First chunk | Total response | 向く場面 |
|---|---|---|---|---|---|---|
| max | 1 | 61 | $2.03 | 64.52s | 73.64s | 夜間プラン、高リスク review 準備 |
| xhigh | 2 | 60 | $1.56 | 38.85s | 48.54s | 安い実行ティアの前の計画ステップ |
| high | 5 | 59 | $1.06 | 24.94s | 33.37s | 強い推論が要る日常エージェントループ |
| medium | 8 | 56 | $0.62 | 5.63s | 15.52s | 対話チャット、小さくスコープした編集 |
| low | — | — | — | — | — | 表を信じる前にベンダー doc で SKU 確認 |
Claude Fable 5(index 60、rank #3)は姉妹ラインで、「Opus lite」ではありません。同スナップショットで 約 110s ファーストチャンク — 深読み向き、ペアプロにはきつい。
TCO:max が静かに勝つ/負ける場所
Cost per task はスナップショットのブレンドで、請求書そのものではありません。それでもパターンは見えます:
月次モデル請求
│
├─ 70% = "lint 修正 / 文言 tweak / 小 diff"
│ └─ max にすべきでない → medium/high
│
├─ 20% = テスト付き複数ファイル機能
│ └─ デフォルト high;プランが一度失敗したら xhigh
│
└─ 10% = 移行 / アーキテクチャ賭け
└─ プランのみ xhigh または max;apply はティアを下げる
「どのモデルが一番賢い?」をやめ、チケットに P0 対話、P1 エージェント batch、P2 プランのみ を付けました。各タグがティア上限に対応します。超過は PR テンプレに一行理由 — 退屈なガバナンスで、請求のサプライズを減らす。
同スナップショットの Kimi K3 はタスク $0.95 だが 約 161s ファーストチャンク。Opus high は タスク単価では高くても、誰かがスピナーを見ているなら エンジニア分の方が安い ことがあります。Kimi K3 vs Claude Opus 5 を参照。
シナリオ(ベンダー争いより先にティア)
| ワークロード | 最初は | エスカレート |
|---|---|---|
| 単一サービス bugfix | medium | 同じプロンプトでテストが二度失敗 |
| 6–10 ファイル機能 | high | パッケージ横断の不変条件が壊れる |
| 移行設計ドキュメント | プラン xhigh、パッチ high | spec 更新なしの scope creep |
| auth / 決済タッチ | high + 人 review | 「max オートパイロット merge」は never |
Opus 4.8 max はスナップショットで 56、約 26s ファーストチャンク。懐かしさで 4.8 に留まるチームも — 端到端の待ち が日常では Opus 5 max に勝つまで、トライアルで証明されない限り。
デフォルトにしないこと
- rank #1 だから max — rank は日付付き天気で、ポリシーではない。
- プランと apply で同一ティア — 計画は高い;apply が慣性で max を継承すべきではない。
- Opus だから diff review を省略 — AI コード review チェックリスト を使う。
方法論とスナップショット規律:Best AI coding models for real projects。長ジョブの harness 注:Kimi K3 for coding agents(対比であり推奨ではない)。
Snapshot: 2026-07-25 DevCove ランキング;Anthropic ティアと AA フィールドは、このページが知る前に動く場合があります。