नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

तुलना किए गए मॉडल

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-30

मेट्रिक Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium रिलीज़: रिलीज़ तिथि अज्ञात निःशुल्क उपलब्ध GLM 5 Turbo GLM 5 Turbo medium रिलीज़: 2026-03-15
स्कोर 8.4 8.5 8.0
रैंक #9 #6 #17
संगति 9.0 10.0 7.9
सही परीक्षण
प्रति प्रयास पास दर 82.4% 76.5% 76.5%
अस्थिर टेस्ट 2 0 5
कुल रन 51 49 51
प्रति परिणाम लागत 1.448 0.000 1.509
कुल लागत $0.189 $0.000 $0.166
???? ??? $0.260 / 1M $0.000 / 1M $1.200 / 1M
????? ??? $1.560 / 1M $0.000 / 1M $4.000 / 1M
आउटपुट टोकन 1,754 1,756 11,865
रीजनिंग टोकन 92,522 77,213 35,632
प्रतिक्रिया समय (औसत) 39.13s 13.94s 17.98s
प्रतिक्रिया समय (अधिकतम) 81.20s 43.55s 194.23s
प्रतिक्रिया समय (कुल) 391.29s 237.01s 305.72s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 205 21,236
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 9.90s 207 7,557
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 362 3,137
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 421 7,906
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 390 2,037
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 270 14,916
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 577 3,632
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 35 16,680
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 9,665 19,279
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 73 8,675
Qwen3.6 Plus Preview 5.1 10.0 0.0% 0 27.05s 111 5,232
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 60 2,216
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 101 7,704
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.54s 102 5,552
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 255 2,183
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 34.57s 340 14,496
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 6.11s 298 6,868
GLM 5 Turbo 7.3 5.8 55.6% 2 5.44s 315 2,702
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 309 909
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 241 446

त्वरित तुलना

तुलना जोड़ी बदलें