ai-garage
News

Claude Opus 5きた!“Fable 5級の頭脳”をなんと半額で――てんびん丸が一次ソース確認つきで整理するよ

2026年7月24日(米国時間)、Anthropic が新モデル『Claude Opus 5』を公開したよ。最上位 Fable 5 に迫る性能を、入力 $5/出力 $25(100万トークンあたり)と“Fable 5の半額”で提供。Frontier-Bench では前世代 Opus 4.8 の約2倍、CursorBench では Fable 5 のピークとの差わずか0.5%。しかも「人の意図どおりにお行儀よくふるまえているか」の評価は歴代最良で、安全のためのブロックも“断って終わり”ではなく別のモデルへ自動で切り替わる方式に作り直されたよ。なぜ『半額でこの性能』が実現できたのか、てんびん丸が整理するよ。

Claude Opus 5きた!“Fable 5級の頭脳”をなんと半額で――てんびん丸が一次ソース確認つきで整理するよ

この記事の要点

  • 2026年7月24日(米国時間)、Anthropic が Claude Opus 5 を公開。100万トークンあたり$5/$25と最上位 Fable 5($10/$50)の半額で、前世代 Opus 4.8 と同じ値段のまま。
  • Anthropic 公表のベンチマークでは、Frontier-Bench v0.1 で前世代 Opus 4.8 の約2倍。いちばんじっくり考えさせる設定の CursorBench 3.2 では、Fable 5 のピークとの差がわずか0.5%まで縮まった。
  • 同じく Anthropic 公表値で、OSWorld 2.0 では Fable 5 の最高スコアを約3分の1のコストで達成。ARC-AGI 3 は競合モデルの約3倍の性能、Zapier AutomationBench は次点モデルの約1.5倍の正答率。
  • Anthropic 自身のふるまい自動チェックでは、望ましくないふるまいのスコアが2.3で歴代最良。安全チェックに引っかかった依頼も拒否で終わらせず、より適したモデルへ自動で切り替わる方式に作り直された。

やっほー、ぼくてんびん丸!

きみは新しいAIモデルが出るたびに「で、いくらするの?」ってちょっと身構えちゃわない? 賢いモデルほど値段も高い——これがずっと当たり前だったんだ。ところが今回 Anthropic が出してきた Claude Opus 5 は、その常識をまっすぐ殴りにきたよ。「最上位級の頭脳を、半額で」——そんな一本なんだ。整理していくね。

何があったの?

2026年7月24日(米国時間)、Anthropic が新しい旗艦(フラグシップ)モデルClaude Opus 5」(モデルID: claude-opus-5)を公開したよ。※旗艦モデルっていうのは、その会社の看板になる一番手のモデルのことだよ。もう Claude.ai・API・Claude Code・Claude Cowork のぜんぶで使えるようになってるんだ。

いちばんの目玉は、同社の最上位モデル『Fable 5』に迫る性能を、はっきり安い値段で出してきたこと。価格を並べると、こんな感じ:

モデル入力(100万トークン)出力(100万トークン)
Claude Opus 5$5$25
Fable 5$10$50

※トークンっていうのは、AIが文章を読み書きするときの“文字のかたまり”の単位だよ。読ませるほうが「入力」、返ってくるほうが「出力」だと思ってね。

そう、きっちり Fable 5 の“半額” なんだ。しかもこの $5/$25 は、前世代の Opus 4.8 と同じ値段。つまり「値段は据え置きのまま、中身だけ大きく賢くなった」ってことなんだよ。速さ重視の Fast モードも用意されていて、基本料金の2倍で約2.5倍速く動くんだって。

どれくらい賢くなったの?

「半額」っていっても、性能がしょぼかったら意味ないよね。でも Anthropic が出してきたベンチマークがなかなか強気なんだ。※ベンチマークっていうのは、いろんなAIを同じ問題で試して実力をくらべる共通テストのことだよ。数字で見てみよう:

ベンチマークOpus 5 の成績
Frontier-Bench v0.1前世代 Opus 4.8 の約2倍のスコア
CursorBench 3.2(いちばんじっくり考えさせる設定=最大 effort)最上位 Fable 5 のピークとの差わずか0.5%
ARC-AGI 3(新規タスク)競合モデルの約3倍の性能
OSWorld 2.0Fable 5 の最高スコアを、約3分の1のコスト
Zapier AutomationBench次点モデルの約1.5倍の正答率

ざっくり言うと、「Fable 5 の知能を、Opus の速さとコストで」ってAnthropicがうたうくらいのバランスAIなんだ。とくに CursorBenchOSWorldAutomationBench みたいな「実際に手を動かして作業する(=エージェント)」系のベンチで強いのがポイントで、コーディングやPC操作の自動化に効いてきそうだよ。

図にすると、Opus 5 の“おいしさ”がひと目でわかると思う:

Claude Opus 5 の性能×コストのポジショニングマップ。前世代Opus 4.8より性能約2倍で価格は据え置き、最上位Fable 5に迫る性能を半額で提供する立ち位置を示した図。

前世代の Opus 4.8 からまっすぐ上(=性能アップ)に伸びて、しかも横位置(=コスト)はほぼそのまま。最上位の Fable 5 とは「性能はほぼ互角なのに、価格は半分」——左上のおいしいゾーンにちゃっかり陣取ってるのがわかるよね。

ただし万能ってわけじゃなくて、サイバー攻撃の悪用タスクや生物学の研究タスクでは、別モデルの『Mythos 5』には及ばないとも正直に書いてある。ここは後の安全の話ともつながるところなんだ。

安全まわりも作り替えてきた

今回おもしろいのは、「賢さ」だけじゃなくて「行動のお行儀」も過去いちばん良くなってると主張してること。AIのふるまいを自動でチェックする試験(automated behavioral audit)では、Fable 5・Sonnet 5・Opus 4.8 のどれよりも「人の意図どおりに、お行儀よくふるまえている」 という評価で、望ましくないふるまいのスコアは 2.3 と歴代最良なんだって。※この「人の意図どおりにふるまえているか」を、AI業界ではアラインメント(整合性)って呼ぶよ。

そのうえで、安全策の“止め方”も作り直されたよ。ポイントは2つ:

  • サイバー分野で“見張り役”が口を出す回数が、Fable 5 比で約85%減 … ※見張り役(分類器)っていうのは、送られてきた依頼が危ないものかどうかを見分ける小さなAIのこと。過剰にブロックしすぎないようにして、代わりに Cyber Verification Program(サイバー検証プログラム)で本当に必要な人には制限つきで許可する方式にしたんだ
  • あやしいと判定されたときは、断らずに“別のモデルへ回す” … 依頼が API の安全チェック(セーフティ分類器)に引っかかったとき、いきなり「拒否」で終わらせず、より適したモデルへ自動で切り替える仕組み(自動フォールバック)が入ったよ

あと開発者向けには、会話の途中でツール(外部連携)を差し替えられる機能も Claude Platform に追加されたんだ。エージェントを組む人にはうれしい変更だね。

ぼくの感想

ぼくがいちばん「うおっ」ってなったのは、やっぱり 価格の置き方なんだ。ふつう新しい旗艦(フラグシップ)モデルって「もっと賢くなりました、だからちょっと高いです」って出てくるものだよね。でも Opus 5 は逆で、値段は Opus 4.8 のまま据え置き、性能だけ約2倍。しかも最上位 Fable 5 の半額。これって「一番いいやつを買ってね」じゃなくて、「ふだん使いの主力を、みんなこっちに寄せてね」っていうメッセージな気がするんだ。

もうひとつ気になったのは、安全策を“ゆるめた”んじゃなくて“賢くした” っぽいところ。ただブロックを減らすんじゃなくて、検証プログラムや「別のモデルへ自動で回す」仕組みとセットにしてる。「必要な人には通す、でも野放しにはしない」——このさじ加減をちゃんと設計してきたのは、けっこう大人な判断だなあと思うよ(あくまでぼくの受け取りだけどね)。

まとめ

Claude Opus 5 は、「Fable 5級の頭脳を半額で」という、コスパの殴り込みみたいな一本だったよ。前世代の2倍の性能を据え置き価格で、しかも「人の意図どおりにお行儀よくふるまえているか」の評価は歴代最良、安全チェックに引っかかっても断って終わりにせず より適したモデルへ自動で切り替わる(フォールバック) ように作り直された——と、性能・値段・安全のぜんぶを一段ずつ底上げしてきた感じなんだ。

新しいモデルが出たら、まず「何がすごい?」の前に「いくらで、どこまでできる?」をセットで見るのがコツだよ。Opus 5 はまさにその“費用対効果”で勝負をかけてきたモデル。きみがふだんAIを使うとき、乗り換えるかどうかの判断材料として頭の隅に置いておくといいよ。それじゃ、またね!

よくある質問

Q.Claude Opus 5 の料金はいくら?
A.100万トークンあたり入力$5/出力$25です。最上位の Fable 5(入力$10/出力$50)のちょうど半額で、前世代 Opus 4.8 と同じ値段に据え置かれました。速さ重視の Fast モードも用意されていて、基本料金の2倍で約2.5倍速く動きます。
Q.Claude Opus 5 はどこで使える?
A.公開時点で Claude.ai・API・Claude Code・Claude Cowork のすべてで使えるようになっています。モデルIDは claude-opus-5 です。公開は2026年7月24日(米国時間)でした。
Q.Opus 5 は前の Opus 4.8 からどれくらい賢くなった?
A.Frontier-Bench v0.1 で前世代 Opus 4.8 の約2倍のスコアと公表されています。値段は据え置きなので、同じ金額で中身だけ大きく賢くなった形です。最上位 Fable 5 との差も、CursorBench 3.2 のいちばんじっくり考えさせる設定(最大 effort)でわずか0.5%まで縮まりました。
Q.Opus 5 が苦手なことは?
A.Anthropic は、サイバー攻撃の悪用にあたるタスクと生物学の研究タスクでは、別モデルの Mythos 5 には及ばないと正直に書いています。すべての分野で一番、というモデルではありません。
Q.安全のためのブロックのしかたは変わった?
A.変わりました。サイバー分野で見張り役(分類器)が口を出す回数が Fable 5 比で約85%減り、代わりに Cyber Verification Program で本当に必要な人には制限つきで許可する方式になりました。あやしいと判定された依頼も、いきなり拒否せず、より適したモデルへ自動で切り替わります。

参考・一次ソース

この記事に出てきた用語・モデル

用語をやさしく解説

まとめて読む

このテーマの動きは、時系列で1ページに整理しています。

この記事をシェア

Xでシェア

関連記事

更新を受け取る