AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.6 27B

概要

DeepSeek V4 Pro vs Qwen3.6 27B の benchmark 比較: Qwen3.6 27B が平均スコアでリードし、6.6 vs 6.2 です。 DeepSeek V4 Pro の benchmark コストが低く、$0.025 vs $0.430 です。 DeepSeek V4 Pro の方が高速で、12.38s vs 59.71s です、成功率は 42.9% vs 60.3% です。

おすすめモデル: DeepSeek V4 Pro - スコアはここでの最高値に近く（6.2 vs 6.6）、Qwen3.6 27B より約 17.8 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-12

指標	DeepSeek V4 Pro DeepSeek V4 Pro none リリース: 2026-04-24	Qwen3.6 27B Qwen3.6 27B medium リリース: 2026-04-20

指標	DeepSeek V4 Pro DeepSeek V4 Pro none リリース: 2026-04-24	Qwen3.6 27B Qwen3.6 27B medium リリース: 2026-04-20
スコア	6.2	6.6
順位	#91	#80
信頼性	8.5	10.0
一貫性	8.5	8.2
正解テスト
試行ごとの合格率	42.9%	60.3%
不安定なテスト	4	5
総実行回数	63	63
結果あたりのコスト	0.660	3.361
合計コスト	$0.025	$0.430
入力価格	$0.435 / 1M	$0.288 / 1M
出力価格	$0.870 / 1M	$3.100 / 1M
合計入力トークン	44,845	39,376
出力トークン	5,349	16,189
推論トークン	0	122,521
応答時間（平均）	12.38s	59.71s
応答時間（最大）	58.65s	168.22s
応答時間（合計）	260.06s	1254.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 DeepSeek V4 Pro

none

Invalid SVG

Cost: $0.000
Time: 300.0s
Tokens: 0 tok

#80 Qwen3.6 27B

medium

Cost: $0.009
Time: 39.6s
Tokens: 3,090 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	3.5	8.0	16.7%	1		14.02s	540	704	0
Qwen3.6 27B	8.3	10.0	75.0%	0		12.62s	453	582	4,311

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	4.6	7.9	22.2%	1		6.11s	7,279	531	0
Qwen3.6 27B	7.7	10.0	66.7%	0		142.99s	5,051	7,968	43,367

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	9.5	10.0	100.0%	0		25.49s	20,773	1,911	0
Qwen3.6 27B	7.0	3.7	66.7%	1		83.07s	15,104	2,088	14,689

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	6.9	5.8	66.7%	1		30.54s	5,633	170	0
Qwen3.6 27B	3.5	1.4	50.0%	2		37.30s	7,778	568	9,404

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	5.3	10.0	33.3%	0		3.17s	666	18	0
Qwen3.6 27B	2.9	7.2	11.1%	1		73.38s	662	3,510	20,352

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	4.3	9.9	0.0%	0		3.75s	471	132	0
Qwen3.6 27B	6.5	3.4	66.7%	1		39.53s	516	81	3,045

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	6.3	10.0	50.0%	0		8.23s	627	64	0
Qwen3.6 27B	10.0	10.0	100.0%	0		37.96s	699	346	6,548

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	7.6	7.2	77.8%	1		15.95s	594	173	0
Qwen3.6 27B	7.7	10.0	66.7%	0		61.14s	696	255	12,044

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	10.0	10.0	100.0%	0		5.92s	8,079	219	0
Qwen3.6 27B	10.0	10.0	100.0%	0		16.88s	8,213	390	2,954

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
DeepSeek V4 Pro	3.0	10.0	0.0%	0		15.59s	183	1,427	0
Qwen3.6 27B	3.0	10.0	0.0%	0		80.99s	204	401	5,807

クイック比較

比較ペアを切り替え

DeepSeek V4 PrononevsQwen3.5-35B-A3Bmedium DeepSeek V4 PrononevsGemma 4 31Bmedium無料で利用可能 DeepSeek V4 PrononevsNemotron 3 Supermedium無料で利用可能 Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 27Bmedium DeepSeek V4 PrononevsGemini 3.1 Flash Liteminimal Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 27Bmedium Gemini 3.1 Flash LitelowvsQwen3.6 27Bmedium DeepSeek V4 PrononevsGemini 3.1 Flash Litelow Gemini 3.5 FlashminimalvsQwen3.6 27Bmedium DeepSeek V4 PrononevsGemini 3.1 Flash Lite Previewlow GPT-5.5nonevsQwen3.6 27Bmedium DeepSeek V4 ProhighvsQwen3.6 27Bmedium