AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Xiaomi: MiMo-V2.5-Pro

Rezumat

Comparație benchmark DeepSeek V3.2 vs MiMo-V2.5-Pro: Scorul mediu este practic egal la 7.5 vs 7.4. DeepSeek V3.2 are costul de benchmark mai mic, $0.044 vs $0.106. MiMo-V2.5-Pro este mai rapid cu 26.13s vs 68.71s, cu rate de reușită de 65.1% vs 68.3%.

Model recomandat: DeepSeek V3.2 - Are cel mai bun scor aici (7.5) și costă de aproximativ 2.4x mai puțin decât MiMo-V2.5-Pro.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică	DeepSeek V3.2 DeepSeek V3.2 medium Lansare: 2025-12-01	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lansare: 2026-04-22

Metrică	DeepSeek V3.2 DeepSeek V3.2 medium Lansare: 2025-12-01	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lansare: 2026-04-22
Scor	7.5	7.4
Rang	#50	#52
Fiabilitate	10.0	10.0
Consistență	7.6	8.5
Teste corecte
Rată de trecere pe încercare	65.1%	68.3%
Teste instabile	6	4
Rulări totale	63	63
Cost per rezultat	0.436	2.541
Cost total	$0.044	$0.106
Preț de intrare	$0.229 / 1M	$0.435 / 1M
Preț de ieșire	$0.344 / 1M	$0.870 / 1M
Total tokenuri de intrare	38,333	40,854
Tokenuri de ieșire	7,186	5,015
Tokenuri de raționament	99,081	97,742
Timp de răspuns (mediu)	68.71s	26.13s
Timp de răspuns (maxim)	376.10s	130.77s
Timp de răspuns (total)	1442.81s	548.65s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 DeepSeek V3.2

medium

Cost: $0.001
Time: 53.6s
Tokens: 1,932 tok

#52 MiMo-V2.5-Pro

medium

Invalid SVG

Cost: $0.000
Time: 300.0s
Tokens: 0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	8.2	7.9	83.3%	1		24.23s	448	3,247	6,953
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.26s	621	323	1,179

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	6.0	7.2	55.6%	1		248.68s	5,717	649	52,014
MiMo-V2.5-Pro	6.2	4.7	66.7%	2		92.07s	6,543	780	51,218

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		93.11s	14,283	571	6,296
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		53.36s	15,060	348	11,870

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		36.09s	7,388	207	7,693
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	7,746	260	8,383

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	2.9	4.4	22.2%	2		24.27s	472	21	6,838
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	630	275	17,023

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	3.4	2.5	33.3%	1		58.29s	314	49	2,189
MiMo-V2.5-Pro	5.5	10.0	0.0%	0		4.02s	492	155	163

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		35.78s	627	1,397	2,845
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	672	82	803

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	7.0	7.2	55.6%	1		37.69s	594	518	6,375
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.31s	660	540	2,181

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		34.81s	8,307	507	859
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	8,220	311	2,908

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	3.0	10.0	0.0%	0		83.99s	183	20	7,019
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		12.46s	210	1,941	2,014

Comparație rapidă

Schimbă perechea de comparație

Gemini 3 Flash PreviewlowvsMiMo-V2.5-Promedium DeepSeek V3.2mediumvsGPT-5.3 Chatnone DeepSeek V3.2mediumvsGemini 3 Flash Previewlow GPT-5.3 ChatnonevsMiMo-V2.5-Promedium Claude Sonnet 4.6nonevsMiMo-V2.5-Promedium Claude Sonnet 4.6nonevsDeepSeek V3.2medium Claude Opus 4.8nonevsMiMo-V2.5-Promedium Claude Opus 4.8nonevsDeepSeek V3.2medium DeepSeek V3.2mediumvsStep 3.7 Flashlow Qwen3.7 PlusnonevsMiMo-V2.5-Promedium Step 3.7 FlashlowvsMiMo-V2.5-Promedium DeepSeek V3.2mediumvsQwen3.7 Plusnone