ai-garage

VS COMPARISON

主要AIモデル
2本ずつ徹底比較。

Claude / ChatGPT / Gemini / Grok / DeepSeek / Llama / Qwen のフロンティアモデル16本を2つずつ並べて、 ベンチマーク・料金・コンテキスト長・強み弱みを横並びで比較します。全120ペア掲載。

SELECT TO COMPARE

VS

どのAIを選べばいいか迷ったら

5問に答えるだけでおすすめがわかるよ

AI診断をやってみる →

ALL PAIRS

全120ペア

フロンティア16モデルの全組み合わせ

Claude Opus 5 vs Claude Fable 5 Claude Opus 5 vs GPT-5.6 Sol Claude Opus 5 vs Kimi K3 Claude Opus 5 vs Qwen3.8-Max Claude Opus 5 vs Gemini 3.1 Pro Claude Opus 5 vs Claude Sonnet 5 Claude Opus 5 vs DeepSeek V4-Pro Claude Opus 5 vs Llama 4 Maverick Claude Opus 5 vs Mistral Large 3 Claude Opus 5 vs GLM-5.3 Claude Opus 5 vs Gemini 3.7 Flash Claude Opus 5 vs Grok 4.6 Claude Opus 5 vs Gemini 3.5 Flash-Lite Claude Opus 5 vs GPT-5.6 Luna Claude Opus 5 vs GPT-5.6 Terra Claude Fable 5 vs GPT-5.6 Sol Claude Fable 5 vs Kimi K3 Claude Fable 5 vs Qwen3.8-Max Claude Fable 5 vs Gemini 3.1 Pro Claude Fable 5 vs Claude Sonnet 5 Claude Fable 5 vs DeepSeek V4-Pro Claude Fable 5 vs Llama 4 Maverick Claude Fable 5 vs Mistral Large 3 Claude Fable 5 vs GLM-5.3 Claude Fable 5 vs Gemini 3.7 Flash Claude Fable 5 vs Grok 4.6 Claude Fable 5 vs Gemini 3.5 Flash-Lite Claude Fable 5 vs GPT-5.6 Luna Claude Fable 5 vs GPT-5.6 Terra GPT-5.6 Sol vs Kimi K3 GPT-5.6 Sol vs Qwen3.8-Max GPT-5.6 Sol vs Gemini 3.1 Pro GPT-5.6 Sol vs Claude Sonnet 5 GPT-5.6 Sol vs DeepSeek V4-Pro GPT-5.6 Sol vs Llama 4 Maverick GPT-5.6 Sol vs Mistral Large 3 GPT-5.6 Sol vs GLM-5.3 GPT-5.6 Sol vs Gemini 3.7 Flash GPT-5.6 Sol vs Grok 4.6 GPT-5.6 Sol vs Gemini 3.5 Flash-Lite GPT-5.6 Sol vs GPT-5.6 Luna GPT-5.6 Sol vs GPT-5.6 Terra Kimi K3 vs Qwen3.8-Max Kimi K3 vs Gemini 3.1 Pro Kimi K3 vs Claude Sonnet 5 Kimi K3 vs DeepSeek V4-Pro Kimi K3 vs Llama 4 Maverick Kimi K3 vs Mistral Large 3 Kimi K3 vs GLM-5.3 Kimi K3 vs Gemini 3.7 Flash Kimi K3 vs Grok 4.6 Kimi K3 vs Gemini 3.5 Flash-Lite Kimi K3 vs GPT-5.6 Luna Kimi K3 vs GPT-5.6 Terra Qwen3.8-Max vs Gemini 3.1 Pro Qwen3.8-Max vs Claude Sonnet 5 Qwen3.8-Max vs DeepSeek V4-Pro Qwen3.8-Max vs Llama 4 Maverick Qwen3.8-Max vs Mistral Large 3 Qwen3.8-Max vs GLM-5.3 Qwen3.8-Max vs Gemini 3.7 Flash Qwen3.8-Max vs Grok 4.6 Qwen3.8-Max vs Gemini 3.5 Flash-Lite Qwen3.8-Max vs GPT-5.6 Luna Qwen3.8-Max vs GPT-5.6 Terra Gemini 3.1 Pro vs Claude Sonnet 5 Gemini 3.1 Pro vs DeepSeek V4-Pro Gemini 3.1 Pro vs Llama 4 Maverick Gemini 3.1 Pro vs Mistral Large 3 Gemini 3.1 Pro vs GLM-5.3 Gemini 3.1 Pro vs Gemini 3.7 Flash Gemini 3.1 Pro vs Grok 4.6 Gemini 3.1 Pro vs Gemini 3.5 Flash-Lite Gemini 3.1 Pro vs GPT-5.6 Luna Gemini 3.1 Pro vs GPT-5.6 Terra Claude Sonnet 5 vs DeepSeek V4-Pro Claude Sonnet 5 vs Llama 4 Maverick Claude Sonnet 5 vs Mistral Large 3 Claude Sonnet 5 vs GLM-5.3 Claude Sonnet 5 vs Gemini 3.7 Flash Claude Sonnet 5 vs Grok 4.6 Claude Sonnet 5 vs Gemini 3.5 Flash-Lite Claude Sonnet 5 vs GPT-5.6 Luna Claude Sonnet 5 vs GPT-5.6 Terra DeepSeek V4-Pro vs Llama 4 Maverick DeepSeek V4-Pro vs Mistral Large 3 DeepSeek V4-Pro vs GLM-5.3 DeepSeek V4-Pro vs Gemini 3.7 Flash DeepSeek V4-Pro vs Grok 4.6 DeepSeek V4-Pro vs Gemini 3.5 Flash-Lite DeepSeek V4-Pro vs GPT-5.6 Luna DeepSeek V4-Pro vs GPT-5.6 Terra Llama 4 Maverick vs Mistral Large 3 Llama 4 Maverick vs GLM-5.3 Llama 4 Maverick vs Gemini 3.7 Flash Llama 4 Maverick vs Grok 4.6 Llama 4 Maverick vs Gemini 3.5 Flash-Lite Llama 4 Maverick vs GPT-5.6 Luna Llama 4 Maverick vs GPT-5.6 Terra Mistral Large 3 vs GLM-5.3 Mistral Large 3 vs Gemini 3.7 Flash Mistral Large 3 vs Grok 4.6 Mistral Large 3 vs Gemini 3.5 Flash-Lite Mistral Large 3 vs GPT-5.6 Luna Mistral Large 3 vs GPT-5.6 Terra GLM-5.3 vs Gemini 3.7 Flash GLM-5.3 vs Grok 4.6 GLM-5.3 vs Gemini 3.5 Flash-Lite GLM-5.3 vs GPT-5.6 Luna GLM-5.3 vs GPT-5.6 Terra Gemini 3.7 Flash vs Grok 4.6 Gemini 3.7 Flash vs Gemini 3.5 Flash-Lite Gemini 3.7 Flash vs GPT-5.6 Luna Gemini 3.7 Flash vs GPT-5.6 Terra Grok 4.6 vs Gemini 3.5 Flash-Lite Grok 4.6 vs GPT-5.6 Luna Grok 4.6 vs GPT-5.6 Terra Gemini 3.5 Flash-Lite vs GPT-5.6 Luna Gemini 3.5 Flash-Lite vs GPT-5.6 Terra GPT-5.6 Luna vs GPT-5.6 Terra

よくある質問

Q.ChatGPT と Claude、どっちがいいですか?
A.第三者測定の総合指標(Artificial Analysis Intelligence Index)は GPT-5.6 Sol が 61、Claude Opus 5 が 63 で、当サイトの基準(差3以上で勝ち)では互角です。API 料金は GPT-5.6 Sol が 入力 $4 / 出力 $20、Claude Opus 5 が 入力 $5 / 出力 $25(いずれも100万トークンあたり)。コード修正の成績(SWE-bench Verified)は Claude Opus 5 が 96% を公表していますが、GPT-5.6 Sol は未公表なので同じ土俵では比べられません。どちらが上とひとことで言える差ではないので、公表値がある項目を用途に当てはめて選ぶのが確実です。ページ上部の選択欄で2つ選ぶと、全ベンチと料金を並べた比較ページに移動できます。
Q.API 料金がいちばん安いAIモデルはどれですか?
A.掲載16モデルのうち料金を公表している15モデルで見ると、入力は GPT-5.6 Luna(OpenAI)の $0.2、出力は GPT-5.6 Luna(OpenAI)の $1.2 がいちばん安い値です(いずれも100万トークンあたり)。ただし安さと成績は別の話で、総合指標がいちばん高いのは Claude Opus 5 の 63 です。
Q.プログラムのコードを書かせるなら、どのAIモデルですか?
A.コード修正の成績(SWE-bench Verified)を公表している6モデルの中では、Claude Opus 5 の 96% がいちばん高く、次が Claude Fable 5 の 95% です。残り10モデルはこのベンチの数値を公表していないため、この順位には入っていません(成績が低いという意味ではありません)。
Q.長い資料をまとめて読ませたいときは、どれを選べばいいですか?
A.一度に読める量(コンテキスト長)は Gemini 3.1 Pro・Gemini 3.7 Flash・Gemini 3.5 Flash-Lite の 104.9万トークンが最大です。掲載16モデルのうち11モデルが100万トークン以上に対応しているので、長さだけで絞ると選択肢は広めに残ります。実際に選ぶときは、料金とベンチの数字も合わせて見てください。
Q.比較できる組み合わせはいくつありますか?
A.掲載16モデルの全組み合わせ、120ペア分の比較ページがあります。ページ上部の選択欄で2つ選べば該当ページに移動します。よく見られている組み合わせは「よく見られているペア」に19件まとめています。
Q.どちらが勝ちかは、どうやって決めていますか?
A.各ペアのページでは、第三者測定の総合指標(Artificial Analysis Intelligence Index)は差が3未満なら互角、コード修正の成績(SWE-bench Verified)は差が1未満なら互角として扱います。どちらか一方でも数値を公表していないベンチは「比較不能」として判定から外し、未公表を0点とはみなしません。料金は安いほうを有利として、成績とは別の軸で表示します。

更新を受け取る