ai-garage

VS COMPARISON

Claude Sonnet 5 vs GPT-5.6 Terra

編集部の総合判定

総合性能は拮抗(AA Index 55 対 57)。用途と料金で選ぶのが正解

ベンチ勝ち:Claude Sonnet 5 0 / GPT-5.6 Terra 0 料金で安い項目:Claude Sonnet 5 1 / GPT-5.6 Terra 0 データ最終更新:2026-08-28(編集部集計)

WHICH ONE

こんな人はどっち?

こんな人は Claude Sonnet 5

  • API 料金を抑えたい人(入力$2/出力$10)
  • 長い資料を読ませたい人(100万トークン)

こんな人は GPT-5.6 Terra

  • AI をはじめて使う人
  • 「総合力が高くてなんでもこなす」を重視する人

SPECS

仕様の比較

項目 Claude Sonnet 5 GPT-5.6 Terra
バージョン Sonnet 5 GPT-5.6 Terra
公開日 2026-06-30 2026-07-09
コンテキスト長 1000K 勝ち 922K
入力料金 $/1M $2 $2
出力料金 $/1M $10 安い $12
推論モデル ✓ あり ✓ あり
マルチモーダル ✓ あり ✓ あり
AIコスパ指数 独自指標 69 70

BENCHMARKS

ベンチマーク差分

バーの長さは100%スケール。長い方が勝ち。

総合知能(AA Intelligence Index)

Claude Sonnet 5
55
GPT-5.6 Terra
57

コード修正力(SWE-Bench)

Claude Sonnet 5
85.2%
GPT-5.6 Terra

最難関試験(HLE)

Claude Sonnet 5
34.6%
GPT-5.6 Terra

AA Intelligence Index(第三者機関 Artificial Analysis の統合知能指標)/ SWE-Bench Verified(実OSSバグ修正)/ MMLU(総合学力)/ GPQA Diamond(博士レベル理系)/ AIME(数学オリンピック予選)/ HLE(Humanity's Last Exam・最難関試験)

※「—」は未公表(実測0ではありません)。未公表の項目は勝敗のカウント対象外です。公式が個別ベンチを公表していないモデルも、AA Intelligence Index は第三者測定のため横並びで比較できます。

X VOICE

Xの評判はどう?

ベンチマークとは別の軸として、直近7日(2026-08-24 〜 2026-08-31)の X上の日本語の声をサンプル分析。てんびん丸総研調べ。

Claude Sonnet 5

X評判スコア 60 /100(n=13)

ポジ 6 ネガ 4 / 中立 3

👍 コストパフォーマンス最強

👍 大型アプリに強い

👎 性能が前モデルより劣る

👎 価格が高く手が出ない

GPT-5.6 Terra

今週の集計にこのモデルのデータはありません。

※ Grok(x_search)で過去7日の日本語Xポストを、モデルごとに3つの角度(感想・活用報告・他モデル比較)から検索してサンプル収集し、ポジ・ネガ・中立をLLM分類した傾向値。全数調査ではなく、角度間の重複除外も完全ではありません。評判スコア=ポジ÷(ポジ+ネガ)×100(判定5件未満は「—」)。 全モデルの一覧と推移は てんびん丸総研へ。

EDITOR'S NOTE

編集部メモ

数値の背景と、いまの提供状況・注意点

Claude Sonnet 5

2026-06-30 リリース。無料・Pro を含む全プランの新デフォルトで、「速度と知能の最良バランス」を掲げるエージェント・コスパ枠(Sonnet 4.6 を置き換え)。料金は $2/$10。当初は「2026-08-31 までの導入価格で、9月から標準の $3/$15 に上がる」と案内されていたが、その期限が撤廃されてこれが通常価格になった(予定されていた値上げは行われない)。SWE-bench Verified は 85.2%(旧 Sonnet 4.6=79.6% から大幅改善。上位の Claude Opus 5 は 96.0%)、Humanity's Last Exam 34.6%(ツールなし)/46.8%(ツールあり)、OSWorld-Verified 78.5%。エージェント型コーディングは 63.2%(発表当時の Opus 4.8=69.2 / Sonnet 4.6=58.1)。GPQA・AIME・MMLU は Anthropic 公式が数値を前面に出しておらず(発表は SWE / エージェント系ベンチ中心)本表では「—」。最高精度が要る局面は上位の Opus 5。本表の「一度に読める量」100万トークンは、Anthropic 公式の context window(会話の履歴と AI の返答を合わせた1つの枠で、返答ぶんの最大12万8千トークンも同じ枠から引かれる。入力だけで枠を超えるとエラーになる)。入力専用の上限を別に公表している Google・OpenAI とは数え方が違う(2026-08-18 に公式ドキュメントで確認)。

GPT-5.6 Terra

GPT-5.6 の3グレード(Sol / Terra / Luna)の中位にあたる「ふだん使い」向けモデル。 ChatGPT では登場時(2026-07-09)に無料プランと Go プランがこの Terra を使っていたが、2026-08-06 の変更で無料・Go は下位の Luna に移った(Plus・Pro は最上位の Sol)。 そのため現在の Terra は、ChatGPT の既定モデルとしてではなく API で中位グレードを選ぶときの選択肢という位置づけになっている。 料金は 2026-07-30 の改定で 100万トークンあたり $2.50/$15 → $2/$12 に20%下がった(同じ日に Luna は80%下がり、Sol はこのときだけ $5/$30 で据え置きだった。その Sol も 2026-08-22 に $4/$20 へ下がっている)。 Artificial Analysis Intelligence Index は 57 で、最上位 Sol の 61 に対して4ポイント差。料金は Sol の6割ほどなので、価格と性能の折り合いをつける位置づけ。 ※ 本表の Sol 行(61)と同じ max 設定・同じ v4.1.1 での測定値(2026-08-11 時点)。AA は推論の強さ別に max / xhigh / high / medium / low を出しており、条件が違うと数値も変わる。 出力速度は 125.7 トークン/秒(Artificial Analysis 実測)。コンテキストウィンドウは OpenAI 公式表記で 1,050,000 トークンだが、入力に使える上限は 922,000 トークン・1回の出力上限は 128,000 トークン。本表の値は「一度に読める量」なので入力上限の 922,000 を採用している。入力が 272,000 トークンを超えたリクエストは全体が入力2倍・出力1.5倍($4/$18)になる(2026-08-18 に公式ドキュメントで確認)。入力はテキストと画像に対応。 GPQA Diamond・HLE・SWE-bench Verified は Terra 個別の公開値が無いため本表では「—」(他グレードの数値では埋めていません)。

PROS & CONS

強み・弱み

Claude Sonnet 5

長文・コード・推論で定評。主力は 7/24 に出た Opus 5、公式の最上位は Fable 5、日常使いは Sonnet 5、軽量は Haiku 4.5。

◎ 強み

  • 長い文書をまとめるのが得意(1M tokens context)
  • コード生成・修正の精度が高い(SWE-Bench で常時トップ争い)
  • 安全側に振った穏やかな応答
  • adaptive thinking で必要に応じて推論時間を自動調整

△ 注意点

  • 画像生成はできない(読み取りのみ)
公式サイト →

GPT-5.6 Terra

AIブームの火付け役。フラッグシップ GPT-5.6(Sol/Terra/Luna)を内蔵し、画像・音声まで一つで完結。

◎ 強み

  • 総合力が高くてなんでもこなす
  • 音声・画像・ファイル対応がスムーズ
  • アプリ・拡張機能が豊富

△ 注意点

  • 話の事実確認は弱め、要ファクトチェック
公式サイト →

FAQ

よくある質問

Q. Claude Sonnet 5 と GPT-5.6 Terra、結局どっちがいい?

A. AA Intelligence Index は Claude Sonnet 5 55、GPT-5.6 Terra 57 とほぼ同水準で、総合性能は拮抗しています。用途・料金・使い勝手で選ぶのが正解です。

Q. Claude Sonnet 5 と GPT-5.6 Terra、料金が安いのはどっち?

A. 入力料金は Claude Sonnet 5 が $2/1M、GPT-5.6 Terra が $2/1M。出力料金は Claude Sonnet 5 が $10/1M、GPT-5.6 Terra が $12/1M です。安い項目は Claude Sonnet 5 が 1 個、GPT-5.6 Terra が 0 個。用途に応じて選んでください。

Q. Claude Sonnet 5 と GPT-5.6 Terra、ベンチマークで強いのはどっち?

A. 両モデルが共通で公表している指標は1項目と少ないため、全モデルを第三者が同一条件で測定している AA Intelligence Index(Claude Sonnet 5 55/GPT-5.6 Terra 57)を軸に判断するのがおすすめです。その AA Intelligence Index でも明確な差は付いていないため、性能は同水準と見て、料金や使い勝手で選ぶのがおすすめです。

Q. Claude Sonnet 5 と GPT-5.6 Terra、コスパがいいのはどっち?

A. AIコスパ指数(第三者測定の知能スコアと料金の安さを 6:4 で合成した編集部独自指標)は Claude Sonnet 5 が 69、GPT-5.6 Terra が 70。差は僅かで、コスパはほぼ同水準。性能・使い勝手など他の軸で選ぶのがおすすめです。

Q. Claude Sonnet 5 と GPT-5.6 Terra、初心者にはどっちがおすすめ?

A. 初心者へのおすすめ度は GPT-5.6 Terra の方が高め(5/5 対 4/5)。まず触ってみるなら GPT-5.6 Terra から始めると迷いにくいです。

更新を受け取る