ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.5-35B-A3B

概要

DeepSeek V4 Pro vs Qwen3.5-35B-A3B の benchmark 比較: 平均スコアは 6.2 vs 6.3 でほぼ同等です。 DeepSeek V4 Pro の benchmark コストが低く、$0.025 vs $0.401 です。 DeepSeek V4 Pro の方が高速で、12.38s vs 72.57s です、成功率は 42.9% vs 69.8% です。

おすすめモデル: DeepSeek V4 Pro - ここでは最高スコア(6.2)で、Qwen3.5-35B-A3B より約 16.6 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-12

指標 DeepSeek V4 Pro DeepSeek V4 Pro none リリース: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium リリース: 2026-02-24
スコア 6.2 6.3
順位 #91 #88
信頼性 8.5 10.0
一貫性 8.5 7.5
正解テスト
試行ごとの合格率 42.9% 69.8%
不安定なテスト 4 6
総実行回数 63 63
結果あたりのコスト 0.660 5.162
合計コスト $0.025 $0.401
入力価格 $0.435 / 1M $0.140 / 1M
出力価格 $0.870 / 1M $1.000 / 1M
合計入力トークン 44,845 42,196
出力トークン 5,349 40,630
推論トークン 0 353,577
応答時間(平均) 12.38s 72.57s
応答時間(最大) 58.65s 409.98s
応答時間(合計) 260.06s 1524.04s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 DeepSeek V4 Pro

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#88 Qwen3.5-35B-A3B

medium
Cost
$0.009
Time
71.4s
Tokens
8,631 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 540 704 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 672 798 42,652
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 4.6 7.9 22.2% 1 6.11s 7,279 531 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 20,773 1,911 0
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 20,992 775 12,485
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 6.9 5.8 66.7% 1 30.54s 5,633 170 0
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 6,061 235 19,493
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 666 18 0
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 500 41 46,368
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 471 132 0
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 172 20 3,753
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 627 64 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 699 97 17,361
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 7.6 7.2 77.8% 1 15.95s 594 173 0
Qwen3.5-35B-A3B 8.2 7.2 88.9% 1 33.13s 597 3,592 26,585
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 8,079 219 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 8,193 309 1,365
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 183 1,427 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 204 10,919 72,053

クイック比較

比較ペアを切り替え