AI BENCHY Compare

比較対象モデル

概要

Qwen3.7 Max vs Qwen3.7 Plus vs Claude Opus 4.7 ベンチマーク比較Qwen3.7 Max はスコアで 9.4 と首位です。 Qwen3.7 Max は信頼性で 10.0 と首位です。 Qwen3.7 Plus は合計コストが最も低く、$0.177 です。 Claude Opus 4.7 は 4.73s で最速です。

おすすめモデル: Claude Opus 4.7 - スコアはここでの最高値に近く（8.7 vs 9.4）、この比較の他のモデルより約 5.8 倍速く応答します。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-12

指標	Qwen3.7 Max Qwen3.7 Max medium リリース: 2026-05-22	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03	Claude Opus 4.7 Claude Opus 4.7 medium リリース: 2026-04-16

指標	Qwen3.7 Max Qwen3.7 Max medium リリース: 2026-05-22	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03	Claude Opus 4.7 Claude Opus 4.7 medium リリース: 2026-04-16
スコア	9.4	8.2	8.7
順位	#4	#28	#17
信頼性	10.0	10.0	10.0
一貫性	9.6	9.1	9.6
正解テスト
試行ごとの合格率	88.9%	77.8%	82.5%
不安定なテスト	1	2	1
総実行回数	63	63	63
結果あたりのコスト	5.517	1.474	3.991
合計コスト	$0.523	$0.177	$0.679
入力価格	$1.250 / 1M	$0.320 / 1M	$5.000 / 1M
出力価格	$3.750 / 1M	$1.280 / 1M	$25.000 / 1M
合計入力トークン	42,360	40,939	65,406
出力トークン	2,129	2,125	11,858
推論トークン	122,959	125,754	2,198
応答時間（平均）	16.02s	38.95s	4.73s
応答時間（最大）	59.98s	178.04s	23.18s
応答時間（合計）	336.51s	817.85s	94.51s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 Qwen3.7 Max

medium

Cost: $0.017
Time: 68.8s
Tokens: 4,526 tok

#28 Qwen3.7 Plus

medium

Cost: $0.018
Time: 193.2s
Tokens: 10,821 tok

#17 Claude Opus 4.7

medium

Cost: $0.059
Time: 26.8s
Tokens: 2,475 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	6.36s	672	222	8,742
Qwen3.7 Plus	10.0	10.0	100.0%	8.58s	672	195	5,065
Claude Opus 4.7	8.3	10.0	75.0%	1.85s	894	348	0

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	0	35.31s	7,893	423	34,808
Qwen3.7 Plus	6.1	6.6	55.6%	1	108.60s	6,472	414	43,576
Claude Opus 4.7	7.6	7.2	77.8%	1	12.96s	10,635	7,629	1,114

複合	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	19.60s	14,934	366	8,405
Qwen3.7 Plus	10.0	10.0	100.0%	65.24s	14,934	366	10,132
Claude Opus 4.7	10.0	10.0	100.0%	21.45s	24,501	2,369	1,084

データ解析と抽出	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	8.80s	7,782	270	6,254
Qwen3.7 Plus	10.0	10.0	100.0%	21.75s	7,782	270	6,713
Claude Opus 4.7	10.0	10.0	100.0%	2.37s	10,533	324	0

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	5.9	7.2	55.6%	1	24.94s	771	61	31,793
Qwen3.7 Plus	3.6	7.2	22.2%	1	45.35s	771	57	27,073
Claude Opus 4.7	7.7	10.0	66.7%	0	1.17s	630	51	0

汎用知能	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	11.70s	516	135	4,457
Qwen3.7 Plus	10.0	10.0	100.0%	25.48s	516	123	3,998
Claude Opus 4.7	10.0	10.0	100.0%	2.87s	723	256	0

指示追従	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	7.46s	699	102	5,452
Qwen3.7 Plus	10.0	10.0	100.0%	16.13s	699	102	5,013
Claude Opus 4.7	10.0	10.0	100.0%	1.57s	939	114	0

パズル解決	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	8.84s	696	259	8,908
Qwen3.7 Plus	10.0	10.0	100.0%	16.38s	696	280	7,312
Claude Opus 4.7	10.0	10.0	100.0%	2.43s	939	370	0

ツール呼び出し	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	10.0	10.0	100.0%	6.63s	8,193	267	1,220
Qwen3.7 Plus	10.0	10.0	100.0%	15.02s	8,193	292	1,831
Claude Opus 4.7	10.0	10.0	100.0%	4.17s	15,339	373	0

雑学	スコア	一貫性	試行ごとの合格率	応答時間（平均）	入力トークン	出力トークン	推論トークン
Qwen3.7 Max	3.0	10.0	0.0%	33.37s	204	24	12,920
Qwen3.7 Plus	3.0	10.0	0.0%	91.07s	204	26	15,041
Claude Opus 4.7	3.0	10.0	0.0%	2.25s	273	24	0

クイック比較

比較ペアを切り替え

GPT-5.5lowvsQwen3.7 Maxmedium DeepSeek V4 FlashhighvsQwen3.7 Plusmedium Gemini 3.5 FlashlowvsQwen3.7 Maxmedium Claude Opus 4.7mediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.7 Plusmedium Claude Opus 4.7mediumvsDeepSeek V4 Flashhigh Gemini 3.5 FlashhighvsQwen3.7 Maxmedium Qwen3.7 PlusmediumvsStep 3.7 Flashlow Claude Opus 4.7mediumvsGemini 3.5 Flashlow Claude Opus 4.7mediumvsGPT-5.5low GPT-5.3 ChatnonevsQwen3.7 Plusmedium Gemini 3 Flash PreviewlowvsQwen3.7 Plusmedium