AI BENCHY Compare

Qwen: Qwen3.7 Max vs Xiaomi: MiMo-V2.5-Pro

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică	Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lansare: 2026-04-22

Metrică	Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lansare: 2026-04-22
Scor	7.9	8.1
Rang	#27	#20
Fiabilitate	10.0	10.0
Consistență	10.0	9.2
Teste corecte
Rată de trecere pe încercare	70.0%	74.1%
Teste instabile	0	2
Rulări totale	60	54
Cost per rezultat	0.719	1.661
Cost total	$0.101	$0.200
Preț de intrare	$2.500 / 1M	$1.000 / 1M
Preț de ieșire	$7.500 / 1M	$3.000 / 1M
Tokenuri de ieșire	1,988	2,790
Tokenuri de raționament	0	52,001
Timp de răspuns (mediu)	1.30s	16.23s
Timp de răspuns (maxim)	3.92s	84.22s
Timp de răspuns (total)	25.95s	292.10s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	242	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.26s	323	1,179

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	6.8	10.0	50.0%	0		1.39s	576	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		32.58s	543	7,485

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	3.0	10.0	0.0%	0		2.17s	171	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		53.36s	348	11,870

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	243	0
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	260	8,383

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	15	0
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	275	17,023

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	120	0
MiMo-V2.5-Pro	5.5	10.0	0.0%	0		4.02s	155	163

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	72	0
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	82	803

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	314	0
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.16s	493	2,187

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	222	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	311	2,908

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	13	0
MiMo-V2.5-Pro	-	-	-	-	-	-	-	-

Comparație rapidă

Schimbă perechea de comparație

GPT-5.4mediumvsQwen3.7 Maxnone Qwen3.7 MaxnonevsGLM 5 Turbomedium Gemini 3.5 FlashminimalvsQwen3.7 Maxnone Qwen3.7 MaxnonevsMiMo-V2.5medium Gemma 4 31BmediumDisponibil gratuitvsQwen3.7 Maxnone Qwen3.7 MaxnonevsGrok 4.3medium Seed-2.0-LitemediumvsQwen3.7 Maxnone Gemini 3.5 FlashminimalvsMiMo-V2.5-Promedium Gemini 3.1 Flash Lite PreviewmediumvsQwen3.7 Maxnone Gemini 3.1 Flash LitemediumvsQwen3.7 Maxnone Gemini 2.5 FlashmediumvsQwen3.7 Maxnone Gemini 3 PRO PreviewmediumvsQwen3.7 Maxnone