AI BENCHY Compare

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-03-12

指標	Qwen3.5-9B Qwen3.5-9B medium リリース: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium リリース: 2026-01-19

指標	Qwen3.5-9B Qwen3.5-9B medium リリース: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium リリース: 2026-01-19
順位	#66	#62
平均スコア	2.6	3.1
一貫性	7.4	6.4
結果あたりのコスト	0.779	1.040
合計コスト	$0.024	$0.042
正解テスト
試行ごとの合格率	35.4%	41.7%
不安定なテスト	5	7
総実行回数	48	48
出力トークン	17,930	38,682
推論トークン	139,706	64,952
応答時間（平均）	71.44s	36.84s
応答時間（最大）	226.38s	174.55s
応答時間（合計）	928.77s	331.58s

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

平均スコア vs 応答時間（平均）

合計出力トークン

平均スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	4.0	7.2	55.6%	1		31.54s	2,410	10,913
GLM 4.7 Flash	4.0	4.5	55.6%	2		27.09s	1,085	5,597

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	10.0	10.0	0.0%	0		0ms	0	0
GLM 4.7 Flash	10.0	2.1	33.3%	1		65.57s	2,585	20,648

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	5.0	5.6	33.3%	1		87.31s	1,383	32,113
GLM 4.7 Flash	5.0	10.0	50.0%	0		1.51s	584	2,755

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	10.0	7.2	22.2%	1		137.75s	11,549	48,475
GLM 4.7 Flash	10.0	4.4	33.3%	2		174.55s	33,000	25,394

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	10.0	1.6	33.3%	1		226.38s	0	30,695
GLM 4.7 Flash	10.0	9.7	0.0%	0		18.14s	18	2,138

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	5.5	5.8	66.7%	1		17.15s	599	4,517
GLM 4.7 Flash	5.0	5.8	66.7%	1		2.97s	388	2,181

Puzzle Solving	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	10.0	10.0	0.0%	0		33.38s	1,545	11,844
GLM 4.7 Flash	10.0	7.2	11.1%	1		12.90s	798	5,225

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	444	1,149
GLM 4.7 Flash	10.0	10.0	100.0%	0		15.95s	224	1,014

クイック比較

比較ペアを切り替え

Grok 4.1 FastnonevsGLM 4.7 Flashmedium MiMo-V2-FlashnonevsGLM 4.7 Flashmedium Mercury 2nonevsGLM 4.7 Flashmedium Qwen3.5-9BnonevsGLM 4.7 Flashmedium Qwen3.5-9BmediumvsMiMo-V2-Flashnone Nemotron 3 Super 120b A12bnone無料で利用可能vsGLM 4.7 Flashmedium Qwen3.5-9BmediumvsGrok 4.1 Fastnone Mercury 2nonevsQwen3.5-9Bmedium Nemotron 3 Super 120b A12bnone無料で利用可能vsQwen3.5-9Bmedium Qwen3 Coder NextnonevsGLM 4.7 Flashmedium GPT-4o-mininonevsGLM 4.7 Flashmedium Kimi K2.5nonevsGLM 4.7 Flashmedium