Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Mistral: Mistral Small 4

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-26

Metrică DeepSeek V3.2 DeepSeek V3.2 none Lansare: 2025-12-01 Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16
Scor 5.7 5.4
Rang #109 #121
Fiabilitate 10.0 10.0
Consistență 8.3 7.1
Teste corecte
Rată de trecere pe încercare 48.3% 45.0%
Teste instabile 4 7
Rulări totale 98 98
Cost per rezultat 0.246 1.275
Cost total $0.020 $0.064
Preț de intrare $0.252 / 1M $0.150 / 1M
Preț de ieșire $0.378 / 1M $0.600 / 1M
Tokenuri de ieșire 14,503 34,715
Tokenuri de raționament 0 82,903
Timp de răspuns (mediu) 14.43s 8.35s
Timp de răspuns (maxim) 115.89s 59.15s
Timp de răspuns (total) 288.55s 167.08s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 3.3 8.2 12.5% 1 9.35s 1,073 0
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 3.1 5.4 16.7% 1 20.87s 4,522 0
Mistral Small 4 5.1 6.8 33.3% 1 44.82s 9,322 38,386
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 2,887 0
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 1,710 0
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 3.0 6.9 16.7% 1 4.17s 21 0
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 7.6 10.0 100.0% 0 9.32s 43 0
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 66 0
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 8.9 10.0 100.0% 0 6.91s 3,642 0
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 14,070 17,186
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 522 0
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V3.2 3.0 10.0 0.0% 0 17.23s 17 0
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 18 1,557

Comparație rapidă

Schimbă perechea de comparație