Google: Gemini 3 Flash Preview vs Qwen: Qwen3.7 Plus

Qwen3.7 Plus (medium) が平均スコアでリードし、7.9 vs 7.4 です。 Gemini 3 Flash Preview (low) の benchmark コストが低く、$0.177 vs $0.267 です。 Gemini 3 Flash Preview (low) の方が高速で、6.28s vs 51.51s です、成功率は 75.8% vs 75.8% です。

おすすめモデルGemini 3 Flash Preview (low)スコアはここでの最高値に近く（7.4 vs 7.9）、Qwen3.7 Plus (medium) より約 1.5 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-25

指標	Gemini 3 Flash Preview Gemini 3 Flash Preview low リリース: 2025-12-17	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03

指標	Gemini 3 Flash Preview Gemini 3 Flash Preview low リリース: 2025-12-17	Qwen3.7 Plus Qwen3.7 Plus medium リリース: 2026-06-03
スコア	7.4	7.9
順位	#69	#43
信頼性	10.0	10.0
一貫性	9.2	8.9
正解テスト
試行ごとの合格率	75.8%	75.8%
不安定なテスト	2	3
総実行回数	66	66
結果あたりのコスト	1.101	2.072
合計コスト	$0.177	$0.267
入力価格	$0.500 / 1M	$0.320 / 1M
出力価格	$3.000 / 1M	$1.280 / 1M
合計入力トークン	123,684	115,233
出力トークン	9,572	6,162
推論トークン	28,518	173,267
応答時間（平均）	6.28s	51.51s
応答時間（最大）	17.13s	315.30s
応答時間（合計）	138.06s	1133.15s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Gemini 3 Flash Preview

low

コスト: $0.007
時間: 12.1s
トークン: 2,289 tok

#43 Qwen3.7 Plus

medium

コスト: $0.018
時間: 193.2s
トークン: 10,821 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

カテゴリ:

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.48s	500	281	3,082
Qwen3.7 Plus	10.0	10.0	100.0%	0		8.58s	672	195	5,065

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	5.8	7.2	44.4%	1		6.00s	8,122	456	7,421
Qwen3.7 Plus	6.1	6.6	55.6%	1		108.60s	6,472	414	43,576

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	3.0	10.0	0.0%	0		10.20s	99,775	7,822	0
Qwen3.7 Plus	8.2	6.9	66.7%	1		190.27s	89,228	4,403	57,645

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		9.40s	7,261	279	3,656
Qwen3.7 Plus	10.0	10.0	100.0%	0		21.75s	7,782	270	6,713

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	5.3	7.2	44.4%	1		8.05s	645	12	6,410
Qwen3.7 Plus	3.6	7.2	22.2%	1		45.35s	771	57	27,073

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.68s	492	120	981
Qwen3.7 Plus	10.0	10.0	100.0%	0		25.48s	516	123	3,998

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	9.9	10.0	100.0%	0		7.02s	621	71	2,752
Qwen3.7 Plus	10.0	10.0	100.0%	0		16.13s	699	102	5,013

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.77s	562	288	3,168
Qwen3.7 Plus	10.0	10.0	100.0%	0		16.38s	696	280	7,312

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.99s	5,550	234	415
Qwen3.7 Plus	10.0	10.0	100.0%	0		15.02s	8,193	292	1,831

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		2.75s	156	9	633
Qwen3.7 Plus	3.0	10.0	0.0%	0		91.07s	204	26	15,041

クイック比較

比較ペアを切り替え