AI BENCHY तुलना
xAI: Grok 4.20 vs Z.ai: GLM 5
बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-10
| मेट्रिक | Grok 4.20 Grok 4.20 medium | GLM 5 GLM 5 none |
|---|---|---|
| स्कोर | 6.9 | 6.5 |
| रैंक | #68 | #80 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.3 | 9.7 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 63.2% | 49.1% |
| अस्थिर टेस्ट | 4 | 1 |
| कुल रन | 57 | 57 |
| प्रति परिणाम लागत | 7.559 | 0.219 |
| कुल लागत | $0.756 | $0.020 |
| ???? ??? | $1.250 / 1M | $0.600 / 1M |
| ????? ??? | $2.500 / 1M | $1.920 / 1M |
| आउटपुट टोकन | 1,784 | 1,972 |
| रीजनिंग टोकन | 128,233 | 0 |
| प्रतिक्रिया समय (औसत) | 14.53s | 4.18s |
| प्रतिक्रिया समय (अधिकतम) | 63.48s | 11.07s |
| प्रतिक्रिया समय (कुल) | 276.06s | 50.12s |
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
DeepSeek V4 ProhighvsGrok 4.20mediumGrok 4.1 FastmediumvsGLM 5noneGemma 4 31Bnoneनिःशुल्क उपलब्धvsGrok 4.20mediumGemini 3.1 Flash LiteminimalvsGrok 4.20mediumGPT-5.5nonevsGrok 4.20mediumMercury 2mediumvsGLM 5noneGemini 3.1 Flash LitenonevsGrok 4.20mediumGPT-5 NanomediumvsGLM 5noneQwen3.5 Plus 2026-02-15nonevsGrok 4.20mediumClaude Sonnet 4.6nonevsGrok 4.20mediumQwen3.6 27BmediumvsGLM 5noneKimi K2.5mediumvsGLM 5none