Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Tencent: Hy3 preview vs Z.ai: GLM 5.1

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică Hy3 preview Hy3 preview high Lansare: 2026-04-22 GLM 5.1 GLM 5.1 none Lansare: 2026-04-07
Scor 8.0 5.6
Rang #22 #113
Fiabilitate 10.0 10.0
Consistență 9.5 8.1
Teste corecte
Rată de trecere pe încercare 77.1% 40.0%
Teste instabile 1 5
Rulări totale 60 60
Cost per rezultat 0.000 0.941
Cost total $0.000 $0.057
Preț de intrare $0.066 / 1M $0.980 / 1M
Preț de ieșire $0.260 / 1M $3.080 / 1M
Tokenuri de ieșire 216,503 3,749
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 56.77s 4.16s
Timp de răspuns (maxim) 149.94s 32.57s
Timp de răspuns (total) 851.49s 83.23s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 8.9 10.0 100.0% 0 15.12s 6,839 0
GLM 5.1 4.0 6.3 25.0% 2 2.11s 305 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 10.0 10.0 100.0% 0 99.76s 38,167 0
GLM 5.1 4.3 9.5 0.0% 0 6.33s 519 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 10.0 10.0 100.0% 0 113.09s 31,319 0
GLM 5.1 2.8 2.1 33.3% 1 32.57s 2,129 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 6.5 10.0 50.0% 0 12.11s 4,323 0
GLM 5.1 10.0 10.0 100.0% 0 1.08s 204 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 5.3 7.2 44.4% 1 109.04s 87,559 0
GLM 5.1 2.9 7.2 11.1% 1 1.99s 24 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 0.0 0.0 0.0% 0 0ms 0 0
GLM 5.1 5.0 10.0 0.0% 0 790ms 39 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 9.9 10.0 100.0% 0 34.02s 13,331 0
GLM 5.1 9.8 10.0 100.0% 0 1.58s 66 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 10.0 10.0 100.0% 0 29.74s 15,503 0
GLM 5.1 6.1 7.8 44.4% 1 1.48s 152 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 10.0 10.0 100.0% 0 78.83s 10,370 0
GLM 5.1 10.0 10.0 100.0% 0 10.68s 300 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Hy3 preview 3.0 10.0 0.0% 0 47.71s 9,092 0
GLM 5.1 3.0 10.0 0.0% 0 2.34s 11 0

Comparație rapidă

Schimbă perechea de comparație