Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Xiaomi: MiMo-V2.5-Pro

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică GPT-5.4 GPT-5.4 medium Lansare: 2026-03-05 MiMo-V2.5-Pro MiMo-V2.5-Pro medium Lansare: 2026-04-22
Scor 7.9 7.6
Rang #27 #40
Fiabilitate 10.0 10.0
Consistență 8.5 8.9
Teste corecte
Rată de trecere pe încercare 75.0% 68.3%
Teste instabile 4 3
Rulări totale 60 60
Cost per rezultat 8.767 2.407
Cost total $1.140 $0.289
Preț de intrare $2.500 / 1M $1.000 / 1M
Preț de ieșire $15.000 / 1M $3.000 / 1M
Tokenuri de ieșire 2,222 4,957
Tokenuri de raționament 68,503 80,301
Timp de răspuns (mediu) 22.31s 21.77s
Timp de răspuns (maxim) 100.41s 130.77s
Timp de răspuns (total) 446.15s 435.33s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 323 1,179
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 8.2 6.7 83.3% 1 54.98s 412 19,995
MiMo-V2.5-Pro 7.0 6.2 66.7% 1 81.67s 769 33,771
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 348 11,870
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 260 8,383
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 275 17,023
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 155 163
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 82 803
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.16s 493 2,187
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 311 2,908
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.4 3.0 10.0 0.0% 0 13.95s 30 1,821
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 12.46s 1,941 2,014

Comparație rapidă

Schimbă perechea de comparație