AI BENCHY Compare

OpenAI: GPT-4o-mini vs Xiaomi: MiMo-V2.5-Pro

Rezumat

Comparație benchmark GPT-4o-mini vs MiMo-V2.5-Pro: MiMo-V2.5-Pro conduce la scorul mediu cu 5.5 vs 5.0. GPT-4o-mini are costul de benchmark mai mic, $0.006 vs $0.017. GPT-4o-mini este mai rapid cu 1.77s vs 1.78s, cu rate de reușită de 23.8% vs 39.7%.

Model recomandat: MiMo-V2.5-Pro - Are cel mai puternic scor din această comparație (5.5) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică	GPT-4o-mini GPT-4o-mini none Lansare: 2024-07-18	MiMo-V2.5-Pro MiMo-V2.5-Pro none Lansare: 2026-04-22

Metrică	GPT-4o-mini GPT-4o-mini none Lansare: 2024-07-18	MiMo-V2.5-Pro MiMo-V2.5-Pro none Lansare: 2026-04-22
Scor	5.0	5.5
Rang	#144	#123
Fiabilitate	10.0	10.0
Consistență	9.9	8.6
Teste corecte
Rată de trecere pe încercare	23.8%	39.7%
Teste instabile	0	4
Rulări totale	63	63
Cost per rezultat	0.119	0.648
Cost total	$0.006	$0.017
Preț de intrare	$0.150 / 1M	$0.435 / 1M
Preț de ieșire	$0.600 / 1M	$0.870 / 1M
Total tokenuri de intrare	31,518	30,724
Tokenuri de ieșire	1,982	3,043
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	1.77s	1.78s
Timp de răspuns (maxim)	7.58s	8.32s
Timp de răspuns (total)	24.80s	37.42s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 GPT-4o-mini

none

Cost: $0.001
Timp: 6.6s
Tokenuri: 742 tok

#123 MiMo-V2.5-Pro

none

Cost: $0.004
Timp: 46.4s
Tokenuri: 4,025 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	4.8	10.0	25.0%	0		1.34s	618	186	0
MiMo-V2.5-Pro	3.3	8.1	8.3%	1		2.67s	645	994	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	3.2	9.6	0.0%	0		1.63s	7,314	367	0
MiMo-V2.5-Pro	4.3	7.8	22.2%	1		1.41s	6,559	485	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	3.0	10.0	0.0%	0		7.58s	8,298	568	0
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		3.54s	4,695	596	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	10.0	10.0	100.0%	0		1.27s	7,161	183	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		1.32s	7,758	249	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	3.0	10.0	0.0%	0		637ms	732	15	0
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		877ms	753	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	4.0	10.0	0.0%	0		909ms	480	66	0
MiMo-V2.5-Pro	4.0	10.0	0.0%	0		2.58s	498	87	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	6.3	10.0	50.0%	0		1.11s	666	69	0
MiMo-V2.5-Pro	6.4	10.0	50.0%	0		1.03s	684	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	3.5	10.0	0.0%	0		1.21s	651	308	0
MiMo-V2.5-Pro	6.7	4.7	77.8%	2		1.30s	678	267	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	10.0	10.0	100.0%	0		2.51s	5,400	205	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.30s	8,238	258	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-4o-mini	3.0	10.0	0.0%	0		794ms	198	15	0
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		1.89s	216	14	0

Comparație rapidă

Schimbă perechea de comparație

CobuddymediumvsGPT-4o-mininone Mistral Small 4mediumvsGPT-4o-mininone MiniMax M2.5mediumvsGPT-4o-mininone MiniMax M2.7mediumvsGPT-4o-mininone GPT-4o-mininonevsQwen3 Coder Nextmedium MiniMax M2.7mediumvsMiMo-V2.5-Pronone North Mini CodemediumDisponibil gratuitvsMiMo-V2.5-Pronone Mistral Small 4mediumvsMiMo-V2.5-Pronone CobuddymediumvsMiMo-V2.5-Pronone Gemini 3.1 Flash LiteminimalvsMiMo-V2.5-Pronone GPT-4o-mininonevsGLM 4.7 Flashmedium MiniMax M2.5mediumvsMiMo-V2.5-Pronone