AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-04-20 vs Qwen: Qwen3.6 35B A3B

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-04-27

指標	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium リリース: 2026-04-20	Qwen3.6 35B A3B Qwen3.6 35B A3B none リリース: 2026-04-20

指標	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium リリース: 2026-04-20	Qwen3.6 35B A3B Qwen3.6 35B A3B none リリース: 2026-04-20
スコア	8.1	5.1
順位	#32	#112
信頼性	9.7	10.0
一貫性	9.0	7.4
正解テスト
試行ごとの合格率	77.8%	39.6%
不安定なテスト	2	5
総実行回数	54	54
結果あたりのコスト	2.065	0.471
合計コスト	$0.269	$0.019
????	$0.400 / 1M	$0.162 / 1M
????	$2.400 / 1M	$0.966 / 1M
出力トークン	2,179	17,503
推論トークン	103,832	0
応答時間（平均）	32.81s	2.87s
応答時間（最大）	92.41s	12.46s
応答時間（合計）	590.65s	46.00s

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		10.84s	215	7,748
Qwen3.6 35B A3B	3.6	7.6	16.7%	1		2.10s	1,571	0

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	7.6	10.0	100.0%	0		85.72s	248	11,081
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		2.05s	921	0

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		92.41s	483	17,490
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		38.32s	270	14,668
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		1.46s	248	0

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	2.9	7.2	11.1%	1		53.10s	63	28,414
Qwen3.6 35B A3B	3.5	4.4	33.3%	2		7.45s	11,381	0

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	4.9	9.6	0.0%	0		25.30s	125	4,792
Qwen3.6 35B A3B	4.4	3.0	33.3%	1		3.51s	1,545	0

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		20.25s	103	7,689
Qwen3.6 35B A3B	6.2	5.8	66.7%	1		1.86s	1,264	0

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	8.2	7.2	88.9%	1		17.58s	324	9,786
Qwen3.6 35B A3B	3.2	9.9	0.0%	0		1.00s	573	0

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		14.72s	348	2,164
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

クイック比較

比較ペアを切り替え

Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-04-20medium Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-04-20medium Qwen3.5 Plus 2026-04-20mediumvsHY3 Previewlow無料で利用可能 Elephant AlphamediumvsQwen3.6 35B A3Bnone GPT-5.2 ChatnonevsQwen3.5 Plus 2026-04-20medium MiniMax M2.7mediumvsQwen3.6 35B A3Bnone Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-04-20medium DeepSeek V4 FlashhighvsQwen3.5 Plus 2026-04-20medium Qwen3.5 Plus 2026-04-20mediumvsHY3 Previewhigh無料で利用可能 GPT-5.3 ChatnonevsQwen3.5 Plus 2026-04-20medium Qwen3.6 35B A3BnonevsGLM 4.7 Flashmedium Mistral Small 4mediumvsQwen3.6 35B A3Bnone