AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Xiaomi: MiMo-V2.5

Rezumat

Comparație benchmark Qwen3.5 Plus 2026-02-15 vs MiMo-V2.5: MiMo-V2.5 conduce la scorul mediu cu 6.7 vs 5.8. Qwen3.5 Plus 2026-02-15 are costul de benchmark mai mic, $0.016 vs $0.063. Qwen3.5 Plus 2026-02-15 este mai rapid cu 2.31s vs 27.11s, cu rate de reușită de 46.0% vs 69.8%.

Model recomandat: Qwen3.5 Plus 2026-02-15 - Oferă cel mai bun compromis per total: scor competitiv (5.8), cost mai mic decât MiMo-V2.5 și timp de răspuns echilibrat.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Lansare: 2026-02-15	MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22

Metrică	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Lansare: 2026-02-15	MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22
Scor	5.8	6.7
Rang	#106	#76
Fiabilitate	10.0	10.0
Consistență	9.4	8.1
Teste corecte
Rată de trecere pe încercare	46.0%	69.8%
Teste instabile	2	5
Rulări totale	63	63
Cost per rezultat	0.204	2.966
Cost total	$0.016	$0.063
Preț de intrare	$0.260 / 1M	$0.140 / 1M
Preț de ieșire	$1.560 / 1M	$0.280 / 1M
Total tokenuri de intrare	45,864	41,838
Tokenuri de ieșire	2,480	2,827
Tokenuri de raționament	0	198,898
Timp de răspuns (mediu)	2.31s	27.11s
Timp de răspuns (maxim)	6.65s	162.44s
Timp de răspuns (total)	34.63s	569.38s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Qwen3.5 Plus 2026-02-15

none

Cost: $0.012
Timp: 153.2s
Tokenuri: 7,787 tok

#76 MiMo-V2.5

medium

Cost: $0.002
Timp: 54.8s
Tokenuri: 5,247 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	4.8	10.0	25.0%	0		1.91s	696	517	0
MiMo-V2.5	10.0	10.0	100.0%	0		4.14s	621	281	1,739

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	4.3	7.9	11.1%	1		2.05s	7,913	473	0
MiMo-V2.5	6.2	4.7	66.7%	2		97.14s	7,422	557	81,977

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		6.65s	18,304	314	0
MiMo-V2.5	10.0	10.0	100.0%	0		16.86s	15,060	363	7,609

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.89s	7,794	243	0
MiMo-V2.5	2.7	5.7	16.7%	1		6.33s	7,746	306	5,714

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		1.17s	789	17	0
MiMo-V2.5	5.3	10.0	33.3%	0		34.53s	735	507	49,478

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	4.4	3.0	33.3%	1		2.26s	522	117	0
MiMo-V2.5	5.4	2.5	66.7%	1		5.37s	492	121	418

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.67s	711	72	0
MiMo-V2.5	9.9	10.0	100.0%	0		1.80s	672	88	801

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	7.7	10.0	66.7%	0		2.71s	714	494	0
MiMo-V2.5	8.2	7.2	88.9%	1		20.25s	660	279	33,254

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		3.33s	8,211	222	0
MiMo-V2.5	10.0	10.0	100.0%	0		7.29s	8,220	303	2,424

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		1.11s	210	11	0
MiMo-V2.5	3.0	10.0	0.0%	0		51.29s	210	22	15,484

Comparație rapidă

Schimbă perechea de comparație

North Mini CodemediumDisponibil gratuitvsQwen3.5 Plus 2026-02-15none Gemini 3.5 FlashminimalvsMiMo-V2.5medium Qwen3.7 MaxnonevsMiMo-V2.5medium Gemini 3 Flash PreviewnonevsMiMo-V2.5medium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5medium Gemini 3.5 FlashnonevsMiMo-V2.5medium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5medium Gemini 3.1 Flash LitelowvsMiMo-V2.5medium Gemini 3.1 Flash LiteminimalvsQwen3.5 Plus 2026-02-15none Step 3.7 FlashhighvsMiMo-V2.5medium MiMo-V2.5mediumvsGLM 5.2none Qwen3.7 PlusnonevsMiMo-V2.5medium