Claude Opus 4.8
長文・コード・推論で定評。最上位は復帰した Fable 5、日常使いは新しい Sonnet 5、軽量は Haiku 4.5。
◎ 強み
- ◎ 長い文書をまとめるのが得意(1M tokens context)
- ◎ コード生成・修正の精度が高い(SWE-Bench で常時トップ争い)
- ◎ 安全側に振った穏やかな応答
- ◎ adaptive thinking で必要に応じて推論時間を自動調整
△ 注意点
- △ 画像生成はできない(読み取りのみ)
VS COMPARISON
Anthropic
Opus 4.8 / 2026-05-28
「Fable 5 級の頭脳をぐっと手頃に。実務の主戦力だよ」
DeepSeek
V4-Pro (1.6T / 49B active) / 2026-04-24
「コスパの鬼。お財布の味方だよ」
編集部の総合判定
純粋なベンチマーク性能では明確に Claude Opus 4.8 優位
WHICH ONE
SPECS
| 項目 | Claude Opus 4.8 | DeepSeek V4-Pro |
|---|---|---|
| バージョン | Opus 4.8 | V4-Pro (1.6T / 49B active) |
| 公開日 | 2026-05-28 | 2026-04-24 |
| コンテキスト長 | 1000K | 1000K |
| 入力料金 $/1M | $5 | $1.74 安い |
| 出力料金 $/1M | $25 | $3.48 安い |
| 推論モデル | ✓ あり | ✓ あり |
| マルチモーダル | ✓ あり | — |
| AIコスパ指数 独自指標 | 64 | 69 勝ち |
BENCHMARKS
バーの長さは100%スケール。長い方が勝ち。
コード修正力(SWE-Bench)
知識の広さ(MMLU)
専門知識(GPQA)
数学(AIME)
※ SWE-Bench Verified(実OSSバグ修正)/ MMLU(総合学力)/ GPQA Diamond(博士レベル理系)/ AIME(数学オリンピック予選)
※「—」は未公表(実測0ではありません)。未公表の項目は勝敗のカウント対象外です。
PROS & CONS
長文・コード・推論で定評。最上位は復帰した Fable 5、日常使いは新しい Sonnet 5、軽量は Haiku 4.5。
◎ 強み
△ 注意点
中国発、コスパとオープン性の象徴。V4 Preview で 1.6T パラメータ MoE が登場。
◎ 強み
△ 注意点
USE CASES
Claude Opus 4.8 か DeepSeek V4-Pro を取り上げてるタスク 7件
PRIMARY SOURCES
FAQ
Q. Claude Opus 4.8 と DeepSeek V4-Pro、結局どっちがいい?
A. ベンチマーク性能では Claude Opus 4.8 が DeepSeek V4-Pro を上回っています(勝ち数 2/0)。純粋な性能重視なら Claude Opus 4.8 が有力です。
Q. Claude Opus 4.8 と DeepSeek V4-Pro、料金が安いのはどっち?
A. 入力料金は Claude Opus 4.8 が $5/1M、DeepSeek V4-Pro が $1.74/1M。出力料金は Claude Opus 4.8 が $25/1M、DeepSeek V4-Pro が $3.48/1M です。入力・出力とも DeepSeek V4-Pro の方が安く、コスト重視なら DeepSeek V4-Pro が有利です。
Q. Claude Opus 4.8 と DeepSeek V4-Pro、ベンチマークで強いのはどっち?
A. SWE-Bench・MMLU・GPQA・AIME などの主要ベンチマークでは Claude Opus 4.8 の勝ち数が多く(2/0)、総合的なベンチ性能では Claude Opus 4.8 が優勢です。
Q. Claude Opus 4.8 と DeepSeek V4-Pro、初心者にはどっちがおすすめ?
A. 初心者へのおすすめ度は Claude Opus 4.8 の方が高め(4/5 対 3/5)。まず触ってみるなら Claude Opus 4.8 から始めると迷いにくいです。
更新を受け取る