Claude Opus 5
長文・コード・推論で定評。主力は 7/24 に出た Opus 5、公式の最上位は Fable 5、日常使いは Sonnet 5、軽量は Haiku 4.5。
◎ 強み
- ◎ 長い文書をまとめるのが得意(1M tokens context)
- ◎ コード生成・修正の精度が高い(SWE-Bench で常時トップ争い)
- ◎ 安全側に振った穏やかな応答
- ◎ adaptive thinking で必要に応じて推論時間を自動調整
△ 注意点
- △ 画像生成はできない(読み取りのみ)
VS COMPARISON
Anthropic
Opus 5 / 2026-07-24
「本表トップの成績なのに、お値段は前と据え置き。迷ったらこれ」
Anthropic
Fable 5 / 2026-06-09
「公式の最上位。ただし数字は Opus 5 とほぼ互角で、お値段は倍だよ」
編集部の総合判定
総合性能は拮抗(AA Index 63 対 62)。用途と料金で選ぶのが正解
WHICH ONE
SPECS
| 項目 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| バージョン | Opus 5 | Fable 5 |
| 公開日 | 2026-07-24 | 2026-06-09 |
| コンテキスト長 | 1000K | 1000K |
| 入力料金 $/1M | $5 安い | $10 |
| 出力料金 $/1M | $25 安い | $50 |
| 推論モデル | ✓ あり | ✓ あり |
| マルチモーダル | ✓ あり | ✓ あり |
| AIコスパ指数 独自指標 | 67 勝ち | 59 |
BENCHMARKS
バーの長さは100%スケール。長い方が勝ち。
総合知能(AA Intelligence Index)
コード修正力(SWE-Bench)
最難関試験(HLE)
※ AA Intelligence Index(第三者機関 Artificial Analysis の統合知能指標)/ SWE-Bench Verified(実OSSバグ修正)/ MMLU(総合学力)/ GPQA Diamond(博士レベル理系)/ AIME(数学オリンピック予選)/ HLE(Humanity's Last Exam・最難関試験)
※「—」は未公表(実測0ではありません)。未公表の項目は勝敗のカウント対象外です。公式が個別ベンチを公表していないモデルも、AA Intelligence Index は第三者測定のため横並びで比較できます。
X VOICE
ベンチマークとは別の軸として、直近7日(2026-08-24 〜 2026-08-31)の X上の日本語の声をサンプル分析。てんびん丸総研調べ。
ポジ 12 / ネガ 6 / 中立 5
👍 作業能力が高い
👍 深い理解・推論力
👎 使い勝手が悪い
👎 性能低下
ポジ 12 / ネガ 10 / 中立 1
👍 意図の汲み取りが優れている
👍 好奇心・自律性が高い
👎 切れ味・鋭さが物足りない
👎 回答が適当・雑
※ Grok(x_search)で過去7日の日本語Xポストを、モデルごとに3つの角度(感想・活用報告・他モデル比較)から検索してサンプル収集し、ポジ・ネガ・中立をLLM分類した傾向値。全数調査ではなく、角度間の重複除外も完全ではありません。評判スコア=ポジ÷(ポジ+ネガ)×100(判定5件未満は「—」)。 全モデルの一覧と推移は てんびん丸総研へ。
EDITOR'S NOTE
数値の背景と、いまの提供状況・注意点
2026-07-24 公開の Anthropic 主力モデル(API は claude-opus-5)。料金は前世代 Opus 4.8 と同じ $5/$25 のまま、最上位 Fable 5($10/$50)のちょうど半額。SWE-bench Verified は公式システムカードで 96.0%(じっくり考えるモードを最大にして5試行平均)で本表最高、Humanity's Last Exam は 56.3%(ツールなし/ツールありは 64.7%。第三者の Artificial Analysis の独自実測では 52.6%)。AA Intelligence Index も 63(v4.1.1・max 設定/2026-08-11 時点)で AA 掲載モデル中1位。ARC-AGI-3 は 30.2%(ARC Prize 財団の検証値、次点 GPT-5.6 Sol の 7.8% を大きく上回る)。GPQA・MMLU・AIME は Anthropic が Opus 5 では公表していないため本表では「—」(前世代 Opus 4.8 の値は流用しません)。前世代からの一番の違いは、じっくり考えるモードが最初からオンになったこと(考える量は5段階・既定 high)。一度に読める量は100万トークン、一度に書ける量は最大12万8千トークン、知識は2026年5月まで。速さ重視の Fast モードは $10/$50(通常の2倍)で約2.5倍速。なお別ベンチの SWE-bench Pro は 79.2%(Opus 4.8=69.2 / Fable 5=80 / GPT-5.6 Sol=64.6)で、本表の SWE-bench Verified とは別のテストです。前世代 Opus 4.8 は公式ドキュメントで旧世代(Legacy)扱いに移りましたが、提供終了は 2027-05-28 より前にはならないと案内されています。本表の「一度に読める量」100万トークンは、Anthropic 公式の context window(会話の履歴と AI の返答を合わせた1つの枠で、返答ぶんの最大12万8千トークンも同じ枠から引かれる。入力だけで枠を超えるとエラーになる)。入力専用の上限を別に公表している Google・OpenAI とは数え方が違う(2026-08-18 に公式ドキュメントで確認)。
Anthropic が「一般提供しているなかで最も高性能」と位置づける最上位モデル。2026-06-09 発表、6-12 に米政府の輸出管理指令で停止したが、6-30 の規制解除を受け 7-1 にグローバル提供再開(日本からは 7-2)。復旧にあたり新しい安全分類器(報告されたジェイルブレイク手口を99%超ブロック、検知時は当時の Opus 4.8 にリルート)を導入。SWE-bench Verified 95.0%・AA Intelligence Index 62(v4.1.1・2026-08-11 時点)は、2026-07-24 に出た Claude Opus 5(96.0% / 63)に本表では数字で抜かれ、価格は倍($10/$50、米国内限定推論は1.1倍)。数値の差はごくわずかなので、コストを見るなら Opus 5、Anthropic の公式な最上位という位置づけを取るならこちら。MMLU・GPQA・AIME は公式未公表。本表の「一度に読める量」100万トークンは、Anthropic 公式の context window(会話の履歴と AI の返答を合わせた1つの枠で、返答ぶんの最大12万8千トークンも同じ枠から引かれる。入力だけで枠を超えるとエラーになる)。入力専用の上限を別に公表している Google・OpenAI とは数え方が違う(2026-08-18 に公式ドキュメントで確認)。
PROS & CONS
長文・コード・推論で定評。主力は 7/24 に出た Opus 5、公式の最上位は Fable 5、日常使いは Sonnet 5、軽量は Haiku 4.5。
◎ 強み
△ 注意点
長文・コード・推論で定評。主力は 7/24 に出た Opus 5、公式の最上位は Fable 5、日常使いは Sonnet 5、軽量は Haiku 4.5。
◎ 強み
△ 注意点
USE CASES
Claude Opus 5 か Claude Fable 5 を取り上げてるタスク 7件
PRIMARY SOURCES
Claude Opus 5
FAQ
Q. Claude Opus 5 と Claude Fable 5、結局どっちがいい?
A. AA Intelligence Index は Claude Opus 5 63、Claude Fable 5 62 とほぼ同水準で、総合性能は拮抗しています。用途・料金・使い勝手で選ぶのが正解です。
Q. Claude Opus 5 と Claude Fable 5、料金が安いのはどっち?
A. 入力料金は Claude Opus 5 が $5/1M、Claude Fable 5 が $10/1M。出力料金は Claude Opus 5 が $25/1M、Claude Fable 5 が $50/1M です。入力・出力とも Claude Opus 5 の方が安く、コスト重視なら Claude Opus 5 が有利です。
Q. Claude Opus 5 と Claude Fable 5、ベンチマークで強いのはどっち?
A. 両モデルが共通で公表している指標は2項目と少ないため、全モデルを第三者が同一条件で測定している AA Intelligence Index(Claude Opus 5 63/Claude Fable 5 62)を軸に判断するのがおすすめです。AA Intelligence Index・SWE-Bench・MMLU・GPQA・AIME などの比較可能な指標では Claude Opus 5 の勝ち数が多く(1/0)、総合的なベンチ性能では Claude Opus 5 が優勢です。
Q. Claude Opus 5 と Claude Fable 5、コスパがいいのはどっち?
A. AIコスパ指数(第三者測定の知能スコアと料金の安さを 6:4 で合成した編集部独自指標)は Claude Opus 5 が 67、Claude Fable 5 が 59。「安くて賢い」バランスでは Claude Opus 5 が有利です。
Q. Claude Opus 5 と Claude Fable 5、初心者にはどっちがおすすめ?
A. 初心者へのおすすめ度は Claude Opus 5・Claude Fable 5 とも同程度(4/5)。どちらも入門用途に向いているので、料金や使いたいツールとの相性で選んで大丈夫です。
RELATED
AIブラウザ/Computer Use — 「PCを触るAI」の普及期
Dia・ChatGPT Atlas・Comet がブラウザのUIを作り変え、Operator / Computer Use はAIにPCを触らせる。
推論モデル革命
「考える時間」を持たせると、AIは数学・コードで人類トップに肉薄する。
MCP(Model Context Protocol)が業界標準に
AnthropicがOSSで公開した「AIに道具を渡す共通規格」が、業界全体に広がっている。
AGI 2027説 — 専門家の予測が一気に前倒し
「AGIは2045年」が定説だったのに、2026年現在『2027〜2030』予想が主流に。
更新を受け取る