Google: Gemini 3 Flash Preview vs Qwen: Qwen3.7 Plus

Gemini 3 Flash Preview (medium) が平均スコアでリードし、9.6 vs 7.9 です。 Qwen3.7 Plus (medium) の benchmark コストが低く、$0.267 vs $0.742 です。 Gemini 3 Flash Preview (medium) の方が高速で、19.20s vs 51.51s です、成功率は 98.5% vs 75.8% です。

おすすめモデルGemini 3 Flash Preview (medium)ここでは最高スコア（9.6）で、Qwen3.7 Plus (medium) より約 2.7 倍速く応答します。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-18

指標	Gemini 3 Flash Preview Gemini 3 Flash Preview medium リリース: 2025-12-17	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03

指標	Gemini 3 Flash Preview Gemini 3 Flash Preview medium リリース: 2025-12-17	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03
スコア	9.6	7.9
順位	#1	#36
信頼性	10.0	10.0
一貫性	9.7	8.9
正解テスト
試行ごとの合格率	98.5%	75.8%
不安定なテスト	1	3
総実行回数	66	66
結果あたりのコスト	3.533	2.072
合計コスト	$0.742	$0.267
入力価格	$0.500 / 1M	$0.320 / 1M
出力価格	$3.000 / 1M	$1.280 / 1M
合計入力トークン	87,861	115,233
出力トークン	5,486	6,162
推論トークン	227,164	173,267
応答時間（平均）	19.20s	51.51s
応答時間（最大）	117.26s	315.30s
応答時間（合計）	422.42s	1133.15s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#1 Gemini 3 Flash Preview

medium

コスト: $0.010
時間: 18.4s
トークン: 3,351 tok

#36 Qwen3.7 Plus

medium

コスト: $0.018
時間: 193.2s
トークン: 10,821 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

カテゴリ:

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.88s	494	330	3,216
Qwen3.7 Plus	10.0	10.0	100.0%	0		8.58s	672	195	5,065

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	8.6	7.6	88.9%	1		84.40s	8,122	462	161,084
Qwen3.7 Plus	6.1	6.6	55.6%	1		108.60s	6,472	414	43,576

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		26.75s	63,717	3,831	23,496
Qwen3.7 Plus	8.2	6.9	66.7%	1		190.27s	89,228	4,403	57,645

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.43s	7,548	279	4,893
Qwen3.7 Plus	10.0	10.0	100.0%	0		21.75s	7,782	270	6,713

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		15.27s	633	12	21,684
Qwen3.7 Plus	3.6	7.2	22.2%	1		45.35s	771	57	27,073

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.19s	486	72	1,905
Qwen3.7 Plus	10.0	10.0	100.0%	0		25.48s	516	123	3,998

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.04s	615	72	2,709
Qwen3.7 Plus	10.0	10.0	100.0%	0		16.13s	699	102	5,013

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.05s	558	183	4,365
Qwen3.7 Plus	10.0	10.0	100.0%	0		16.38s	696	280	7,312

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		12.60s	5,532	234	1,487
Qwen3.7 Plus	10.0	10.0	100.0%	0		15.02s	8,193	292	1,831

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.50s	156	11	2,325
Qwen3.7 Plus	3.0	10.0	0.0%	0		91.07s	204	26	15,041

クイック比較

比較ペアを切り替え

Gemini 3 Flash PreviewmediumvsGPT-5.6 Sollow GPT-5.6 TerrahighvsQwen3.7 Plusmedium Kimi K3maxvsQwen3.7 Plusmedium Claude Opus 4.8lowvsQwen3.7 Plusmedium Qwen3.7 PlusmediumvsGLM 5.2high GPT-5.2 ChatnonevsQwen3.7 Plusmedium GPT-5.6 LunahighvsQwen3.7 Plusmedium Qwen3.7 PlusmediumvsInklinghigh DeepSeek V4 FlashhighvsQwen3.7 Plusmedium Muse Spark 1.1highvsQwen3.7 Plusmedium DeepSeek V4 ProhighvsQwen3.7 Plusmedium Gemini 3 Flash PreviewmediumvsGPT-5.6 Solhigh