AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Mistral: Mistral Small 4

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-04-11

指標	DeepSeek V3.2 DeepSeek V3.2 none リリース: 2025-12-01	Mistral Small 4 Mistral Small 4 medium リリース: 2026-03-16

指標	DeepSeek V3.2 DeepSeek V3.2 none リリース: 2025-12-01	Mistral Small 4 Mistral Small 4 medium リリース: 2026-03-16
スコア	6.1	5.7
順位	#61	#69
一貫性	8.1	6.8
正解テスト
試行ごとの合格率	50.0%	50.0%
不安定なテスト	4	7
総実行回数	54	54
結果あたりのコスト	0.226	0.674
合計コスト	$0.016	$0.034
????	$0.260 / 1M	$0.150 / 1M
????	$0.380 / 1M	$0.600 / 1M
出力トークン	8,384	15,084
推論トークン	0	39,408
応答時間（平均）	12.09s	5.64s
応答時間（最大）	115.89s	30.49s
応答時間（合計）	217.56s	101.52s

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	3.2	9.8	0.0%	0		7.63s	1,419	0
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	4,055	4,778

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	2.4	1.3	33.3%	1		7.63s	553	0
Mistral Small 4	6.7	3.5	66.7%	1		30.49s	2,796	11,296

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	6.5	10.0	0.0%	0		115.89s	2,887	0
Mistral Small 4	3.0	10.0	0.0%	0		25.25s	2,612	10,700

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	6.3	5.8	66.7%	1		9.42s	1,710	0
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	335	723

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	3.6	7.2	22.2%	1		1.61s	24	0
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	2,621	6,904

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	10.0	10.0	100.0%	0		2.86s	67	0
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	821	828

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	540	1,031

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	8.5	7.5	88.9%	1		7.37s	1,136	0
Mistral Small 4	3.4	9.7	0.0%	0		2.00s	983	2,338

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	321	810

クイック比較

比較ペアを切り替え

Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsGLM 4.7 Flashnone Mistral Small 4mediumvsGLM 5.1none Mistral Small 4mediumvsKimi K2.5none Mistral Small 4mediumvsGLM 5 Turbonone DeepSeek V3.2nonevsGPT-5 Nanomedium Mistral Small 4mediumvsQwen3.5-27Bnone Mistral Small 4mediumvsGPT-5.4none DeepSeek V3.2nonevsgpt-oss-120bmedium無料で利用可能 Trinity Large Previewnone無料で利用可能vsMistral Small 4medium Mistral Small 4mediumvsMiMo-V2-Pronone DeepSeek V3.2nonevsMercury 2medium