Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M2.5 vs Z.ai: GLM 4.7 Flash

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-29

Metrică MiniMax M2.5 MiniMax M2.5 medium Lansare: 2026-02-12 Disponibil gratuit GLM 4.7 Flash GLM 4.7 Flash none Lansare: 2026-01-19
Scor 5.5 5.6
Rang #123 #118
Fiabilitate 10.0 10.0
Consistență 6.4 8.7
Teste corecte
Rată de trecere pe încercare 48.3% 38.3%
Teste instabile 9 3
Rulări totale 60 60
Cost per rezultat 6.075 0.053
Cost total $0.304 $0.004
Preț de intrare $0.150 / 1M $0.060 / 1M
Preț de ieșire $1.150 / 1M $0.400 / 1M
Tokenuri de ieșire 109,492 2,515
Tokenuri de raționament 251,674 0
Timp de răspuns (mediu) 49.87s 3.01s
Timp de răspuns (maxim) 237.27s 7.05s
Timp de răspuns (total) 598.39s 39.12s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 286 45,344
GLM 4.7 Flash 5.2 7.9 41.7% 1 5.51s 438 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 3.5 9.8 0.0% 0 125.80s 354 27,037
GLM 4.7 Flash 5.0 10.0 0.0% 0 3.35s 644 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 740 9,713
GLM 4.7 Flash 3.0 10.0 0.0% 0 3.22s 704 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 266 3,835
GLM 4.7 Flash 7.3 5.8 83.3% 1 4.82s 196 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 105,047 133,487
GLM 4.7 Flash 7.7 10.0 66.7% 0 744ms 19 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 25 1,686
GLM 4.7 Flash 4.0 10.0 0.0% 0 1.59s 134 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 156 1,495
GLM 4.7 Flash 6.5 10.0 50.0% 0 888ms 62 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 1,069 9,605
GLM 4.7 Flash 6.4 10.0 33.3% 0 1.20s 97 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 269 937
GLM 4.7 Flash 2.8 1.6 33.3% 1 7.05s 212 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 1,280 18,535
GLM 4.7 Flash 3.0 10.0 0.0% 0 692ms 9 0

Comparație rapidă

Schimbă perechea de comparație