Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs MiniMax: MiniMax M2.5

Rezumat

Comparație benchmark DeepSeek V4 Flash vs MiniMax M2.5: MiniMax M2.5 conduce la scorul mediu cu 5.3 vs 5.0. DeepSeek V4 Flash are costul de benchmark mai mic, $0.008 vs $0.385. DeepSeek V4 Flash este mai rapid cu 26.75s vs 65.37s, cu rate de reușită de 30.2% vs 46.0%.

Model recomandat: DeepSeek V4 Flash - Scorul rămâne aproape de cel mai bun scor de aici (5.0 vs 5.3) și costă de aproximativ 50.5x mai puțin decât MiniMax M2.5.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-04

Metrică DeepSeek V4 Flash DeepSeek V4 Flash none Lansare: 2026-04-24 MiniMax M2.5 MiniMax M2.5 medium Lansare: 2026-02-12
Scor 5.0 5.3
Rang #139 #129
Fiabilitate 10.0 10.0
Consistență 8.9 6.5
Teste corecte
Rată de trecere pe încercare 30.2% 46.0%
Teste instabile 3 9
Rulări totale 63 63
Cost per rezultat 0.203 7.900
Cost total $0.008 $0.385
Preț de intrare $0.099 / 1M $0.150 / 1M
Preț de ieșire $0.197 / 1M $1.150 / 1M
Total tokenuri de intrare 50,127 43,706
Tokenuri de ieșire 13,710 109,495
Tokenuri de raționament 0 330,814
Timp de răspuns (mediu) 26.75s 65.37s
Timp de răspuns (maxim) 111.96s 251.36s
Timp de răspuns (total) 561.82s 849.76s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 DeepSeek V4 Flash

none
Cost
$0.004
Time
157.6s
Tokens
11,297 tok

#129 MiniMax M2.5

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 3.0 10.0 0.0% 0 20.18s 540 174 0
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 4.2 7.4 11.1% 1 17.13s 7,279 9,717 0
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 4.5 2.1 66.7% 1 111.96s 24,398 2,664 0
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 10.0 10.0 100.0% 0 23.79s 7,290 195 0
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 5.3 10.0 33.3% 0 19.73s 666 18 0
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 4.2 9.9 0.0% 0 23.74s 471 67 0
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 6.5 10.0 50.0% 0 17.54s 627 321 0
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 3.1 7.3 11.1% 1 23.72s 594 207 0
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 10.0 10.0 100.0% 0 77.93s 8,079 327 0
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Flash 3.0 10.0 0.0% 0 3.07s 183 20 0
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535

Comparație rapidă

Schimbă perechea de comparație