Claude最新モデル比較|2026年8月の料金・性能・使い分けガイド

AI

Claude APIの請求額が先月ちょっと跳ねていて、「そもそも今どのモデルが最適なんだ?」と我に返ったのがきっかけです。

普段はLambdaからClaudeを叩いて、記事のネタ整理とかログの要約をやらせているんですが、モデル名を一度決めたらそのまま放置しがちでして。気づいたらAnthropicのラインナップが自分の認識と全然違うことになっていました。というわけで2026年8月時点の状況を、自分用のメモとして整理しておきます。

この記事でわかること

  • 2026年8月時点でClaudeは4階層モデル構成(Haiku/Sonnet/Opus/Fable)
  • 各モデルの料金単価と性能の違い
  • Sonnet 5導入価格が8月31日で終了する重要な情報
  • effort control・fast mode・prompt cachingなど最新機能
  • 用途別モデル選択ガイド

2026年8月時点のClaudeモデル、4階層になってる

まず前提として、Anthropicのモデルは下位から上位に向かって Haiku → Sonnet → Opus → Fable という4階層になっています。以前は Haiku / Sonnet / Opus の3つだったので、上にもう1段積まれた形ですね。Fable系(Mythosという名前も見かけます)は最上位の推論寄りモデルという位置づけらしいです。

本番向けとして推奨されているのは、ざっくりこの4つ。

  • Haiku 4.5 … 一番安い軽量モデル。バージョン番号が据え置きなのが逆に安心感ある
  • Sonnet 5 … 中核モデル。2026年6月30日発表で、Sonnet 4.6の後継とされています
  • Opus 5 … フラッグシップ。Opus 4.7 → 4.8 → 5 という流れのようです
  • Fable 5 … 最上位。正直まだ触ってないです(値段を見て手が止まった)

ここで一点、正直に書いておくと、Opus 4.8からOpus 5に切り替わった正確なタイミングを自分は追いきれていません。4月にOpus 4.7、5月末にOpus 4.8、6月末にSonnet 5、という間隔なので、たぶん7月あたりなんだろうなという推測です。この速度は追いかける側としてはなかなかしんどい。

料金比較|1Mトークンあたりの単価

入力/出力の単価(USD / 百万トークン)を並べるとこうなります。

  • Haiku 4.5 … $1 / $5
  • Sonnet 5 … $3 / $15(ただし導入価格として $2 / $10 が適用中)
  • Opus 5 … $5 / $25
  • Fable 5 … $10 / $50

ここが今回いちばん書きたかった点なんですが、Sonnet 5の導入価格 $2 / $10 は2026年8月31日までで、そのあと標準の $3 / $15 になります。つまり9月から入力コストが1.5倍。Sonnetを主力にしている人は、来月の請求書で「あれ?」となる可能性があります。自分は先週これに気づいて青くなりました。

面白いのは、Sonnet 5がSonnet 4.6と同じ料金水準のまま性能だけ底上げされている点です。コーディングやツール活用を含むエージェント的なタスクだと、上位のOpus世代にかなり近いところまで来ているという評価をよく見ます。単純な価格差はOpusに対して約1.7倍あるので、「まずSonnet 5で試して、精度が足りないところだけOpusに逃がす」という順番が素直かなと。

Opus世代で入った effort control と fast mode

Opus 4.8の世代から入った仕組みで、個人的に一番「へえ」と思ったのがこの2つです。

ひとつは effort control。low / medium / high / xhigh / max といったレベルで、モデルがどれだけ考える(=トークンを燃やす)かを指定できます。従来のextended thinkingのトークン上限指定より意図が明示的で、「この処理はそんなに悩まなくていい」というのを伝えられるのが助かります。コスト管理の観点だと、モデル選択より先にここを見直したほうが効く場面もありそう。

もうひとつが fast mode。fast modeはOpus 5で「最大2.5x高速、料金は標準の2倍」と案内されています。以前の高速モードは正直「誰が使うんだこの価格」という感想だったんですが、これなら対話系のUIで検討する余地が出てきました。

あと地味に重要なのがトークナイザの変更です。Opus 4.7以降は新しいトークナイザになっていて、同じテキストでもOpus 4.6比で最大35%ほどトークン数が増えることがあるらしいです。単価が同じでも消費トークンが増えれば請求は増えるので、旧世代からの移行で「単価変わってないのに高い」と感じたらここを疑うポイントかもしれません。この手の話はリリースノートの片隅に書かれがちで、見落としやすいところです。

コスト側の逃げ道:キャッシュとバッチ

モデルを下げる以外の手も一応あって、prompt cachingでキャッシュヒットした入力は最大90%オフ、Batch APIは全モデル一律50%オフです。自分の用途(毎朝のログ要約バッチ)は完全に非同期なので、Batchに寄せるだけで単純に半額になりました。これは素直に嬉しい。

実装は普通にSDKで、モデルIDだけ環境変数にしています。

import os
from anthropic import Anthropic

client = Anthropic()
MODEL = os.environ["CLAUDE_MODEL"]  # 例: claude-opus-4-8

resp = client.messages.create(
    model=MODEL,
    max_tokens=2048,
    system=[{
        "type": "text",
        "text": SYSTEM_PROMPT,
        "cache_control": {"type": "ephemeral"},  # ここ注意:systemを長文にして初めて効く
    }],
    messages=[{"role": "user", "content": user_text}],
)
print(resp.usage)

キャッシュは短いプロンプトだと最小トークン数を下回って効かないので、usageの cache_read_input_tokens を必ず見たほうがいいです。自分は最初「効いてるつもり」で数日走らせていました。

モデルIDについてひとつ補足。claude-opus-4-8 のような日付なしの名前は、evergreenなエイリアスではなくピン留めされたスナップショットとして扱われるとドキュメントに書かれています。勝手に次のOpusに移動しないので、評価結果の再現性という意味では安心ですが、逆に言うと「放っておくと古いモデルを使い続ける」ということでもあります。まさに自分がやっていたやつです。あと、Bedrock経由とClaude API直だとIDの書式が違うので、そこは毎回ドキュメントを見に行くのが確実です。

で、結局どう使い分けるか

今の自分の暫定ルールはこんな感じです。

  • 分類・抽出・短い要約 → Haiku 4.5(安さが正義。精度が足りなければ上げる)
  • 記事の下書き、コードレビュー、日常のほぼ全部 → Sonnet 5
  • 設計を任せたい、複数ファイルにまたがるリファクタ → Opus 5(effort控えめ)
  • Fable 5 → 未使用。使いどころが思いついたら試したい

ベンチマークの数字も一応見てはいるんですが、自分の用途との相関が正直よくわからないので、最近は「自分の過去タスク20件を投げて比べる」みたいな雑な評価をしています。もっといい方法がある気がするので、そこは引き続き模索中。

余談ですが、モデル名が 4.6 → 4.7 → 4.8 → 5 と刻まれていくので、記事や社内ドキュメントに書いた固有名詞が半年で化石になります。自分のメモはもう「Sonnet系の最新」みたいな書き方に逃げました。

※この記事にはプロモーションが含まれます

ちなみに、PLAUD NOTE(AIボイスレコーダー。録音から文字起こし・要約まで自動で行える)も気になっています。PLAUD NOTE

まとめ

2026年8月時点でのClaudeモデル選択のポイントをまとめると:

  • 料金優先なら:Sonnet 5の導入価格終了(8月31日まで)に注意。9月からコストが1.5倍になる
  • 汎用性なら:Sonnet 5がバランスが良く、コストパフォーマンスが高い
  • 精度優先なら:Opus 5で effort controlを low に設定して試す
  • コスト削減:モデル変更より先に、prompt caching と Batch API の活用を検討する価値がある

effort control を low / high で切り替えたときのコストと精度をちゃんと測ってみたいです。あと1Mトークンコンテキストが追加料金なしで使える世代になったらしいので、RAGを組む前にまず全部投げてみる、というのが成立するのか試したい。もし「Sonnet 5で十分だった」で終わったら、それはそれで一番平和な結論だと思います。

参考になったらクリックしてもらえると嬉しいです!

Blogmura AIAI Ranking
タイトルとURLをコピーしました