Google: Gemini 3.5 Flash vs Qwen: Qwen3.6 Max Preview

Gemini 3.5 Flash (medium) が平均スコアでリードし、9.1 vs 8.4 です。 Gemini 3.5 Flash (medium) の benchmark コストが低く、$0.642 vs $1.143 です。 Gemini 3.5 Flash (medium) の方が高速で、8.20s vs 67.53s です、成功率は 87.9% vs 80.3% です。

おすすめモデルGemini 3.5 Flash (medium)ここでは最高スコア（9.1）で、Qwen3.6 Max Preview (medium) より約 1.8 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-25

指標	Gemini 3.5 Flash Gemini 3.5 Flash medium リリース: 2026-05-19	Qwen3.6 Max Preview Qwen3.6 Max Preview medium リリース: 2026-04-20

指標	Gemini 3.5 Flash Gemini 3.5 Flash medium リリース: 2026-05-19	Qwen3.6 Max Preview Qwen3.6 Max Preview medium リリース: 2026-04-20
スコア	9.1	8.4
順位	#14	#25
信頼性	10.0	9.9
一貫性	9.7	8.9
正解テスト
試行ごとの合格率	87.9%	80.3%
不安定なテスト	1	3
総実行回数	66	66
結果あたりのコスト	3.374	8.173
合計コスト	$0.642	$1.143
入力価格	$1.500 / 1M	$1.040 / 1M
出力価格	$9.000 / 1M	$6.240 / 1M
合計入力トークン	69,747	79,240
出力トークン	2,166	5,098
推論トークン	57,436	164,842
応答時間（平均）	8.20s	67.53s
応答時間（最大）	76.68s	238.07s
応答時間（合計）	180.47s	1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#14 Gemini 3.5 Flash

medium

コスト: $0.201
時間: 112.9s
トークン: 22,371 tok

#25 Qwen3.6 Max Preview

medium

コスト: $0.024
時間: 76.5s
トークン: 3,861 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

カテゴリ:

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.09s	492	171	3,385
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	672	228	10,075

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	7.9	7.5	77.8%	1		12.63s	8,118	461	24,939
Qwen3.6 Max Preview	8.8	7.8	88.9%	1		146.48s	7,895	427	52,957

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		44.36s	45,684	516	8,835
Qwen3.6 Max Preview	7.3	5.8	83.3%	1		177.48s	51,812	3,215	35,050

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		4.07s	7,548	279	3,784
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	7,782	270	10,106

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	7.7	10.0	66.7%	0		5.24s	633	12	8,047
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	771	60	30,371

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.52s	486	115	1,144
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	516	129	3,510

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	9.9	10.0	100.0%	0		2.70s	615	71	2,855
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	699	103	5,848

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	7.7	10.0	66.7%	0		2.38s	558	295	2,747
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.32s	696	329	7,693

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.81s	5,457	234	455
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	8,193	309	1,571

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.75s	156	12	1,245
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		60.56s	204	28	7,661

クイック比較

比較ペアを切り替え

Qwen3.6 Max PreviewmediumvsGrok 4.5low Claude Opus 5highvsGemini 3.5 Flashmedium Claude Opus 5lowvsQwen3.6 Max Previewmedium Muse Spark 1.1lowvsQwen3.6 Max Previewmedium Gemini 3.5 FlashmediumvsGrok 4.5high Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.6 Solhigh Muse Spark 1.1highvsQwen3.6 Max Previewmedium Gemini 3.5 Flash-LitehighvsQwen3.6 Max Previewmedium Qwen3.6 Max PreviewmediumvsInklinghigh GPT-5.2 ChatnonevsQwen3.6 Max Previewmedium Gemini 3.5 FlashmediumvsGPT-5.6 Sollow