AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs Xiaomi: MiMo-V2-Omni

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-14

Metrică	Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Lansare: 2026-02-24	MiMo-V2-Omni MiMo-V2-Omni none Lansare: 2026-03-18

Metrică	Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Lansare: 2026-02-24	MiMo-V2-Omni MiMo-V2-Omni none Lansare: 2026-03-18
Scor	8.1	6.5
Rang	#17	#52
Consistență	8.6	10.0
Teste corecte
Rată de trecere pe încercare	79.6%	44.4%
Teste instabile	3	0
Rulări totale	54	20
Cost per rezultat	4.060	0.083
Cost total	$0.528	$0.007
Preț de intrare	$0.260 / 1M	$0.400 / 1M
Preț de ieșire	$2.080 / 1M	$2.000 / 1M
Tokenuri de ieșire	17,635	868
Tokenuri de raționament	162,668	0
Timp de răspuns (mediu)	31.38s	1.99s
Timp de răspuns (maxim)	119.29s	6.81s
Timp de răspuns (total)	564.84s	35.81s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		9.75s	269	16,835
MiMo-V2-Omni	4.8	10.0	25.0%	0		1.10s	74	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	4.7	1.6	66.7%	1		70.98s	322	10,694
MiMo-V2-Omni	6.6	10.0	0.0%	0		1.72s	399	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		107.79s	483	11,337
MiMo-V2-Omni	3.0	10.0	0.0%	0		2.47s	110	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		23.41s	270	16,558
MiMo-V2-Omni	10.0	10.0	100.0%	0		1.69s	83	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	2.9	7.2	11.1%	1		63.40s	15,537	64,889
MiMo-V2-Omni	5.3	10.0	33.3%	0		1.14s	8	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	3.4	2.2	33.3%	1		34.11s	66	7,592
MiMo-V2-Omni	4.5	10.0	0.0%	0		1.19s	37	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		9.88s	77	7,372
MiMo-V2-Omni	6.5	10.0	50.0%	0		4.18s	22	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		17.18s	289	26,165
MiMo-V2-Omni	8.0	10.0	66.7%	0		2.71s	58	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		4.60s	322	1,226
MiMo-V2-Omni	10.0	10.0	100.0%	0		2.76s	77	0

Comparație rapidă

Schimbă perechea de comparație

Gemini 3 Flash PreviewnonevsQwen3.5-122B-A10Bmedium Mercury 2mediumvsMiMo-V2-Omninone Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-122B-A10Bmedium GPT-5 NanomediumvsMiMo-V2-Omninone Grok 4.1 FastmediumvsMiMo-V2-Omninone GPT-5.2 ChatnonevsQwen3.5-122B-A10Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-122B-A10Bmedium Nemotron 3 SupermediumDisponibil gratuitvsMiMo-V2-Omninone GPT-5.3 ChatnonevsQwen3.5-122B-A10Bmedium Grok 4.20mediumvsMiMo-V2-Omninone Kimi K2.5mediumvsMiMo-V2-Omninone GPT-5 MinimediumvsMiMo-V2-Omninone