- क्रमांक
- #96
- एकूण आउटपुट टोकन्स
- 38,048
- प्रतिसाद वेळ (सरासरी)
- 14.55s
- एकूण खर्च
- $0.449
Grok 4.6 (low) vs GLM 5.3 (high)
average score जवळपास समान आहे: 7.4 vs 7.3. GLM 5.3 (high) चा benchmark खर्च कमी आहे: $0.403 vs $0.449. Grok 4.6 (low) वेगवान आहे: 14.55s vs 27.82s, pass rates 69.7% vs 74.2%.
- क्रमांक
- #99
- एकूण आउटपुट टोकन्स
- 63,667
- प्रतिसाद वेळ (सरासरी)
- 27.82s
- एकूण खर्च
- $0.403
शिफारस केलेले मॉडेल
Grok 4.6 (low)
It has the best score here (7.4), while responding about 1.9x faster than GLM 5.3 (high).
तपशीलवार तुलना
| मेट्रिक | Grok 4.6 Grok 4.6 low | GLM 5.3 GLM 5.3 high |
|---|---|---|
| स्कोअर | 7.4 | 7.3 |
| क्रमांक | #96 | #99 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 9.6 | 7.5 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 69.7% | 74.2% |
| अस्थिर चाचण्या | 1 | 7 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 2.989 | 3.099 |
| एकूण खर्च | $0.449 | $0.403 |
| इनपुट किंमत | $2.000 / 1M | $1.400 / 1M |
| आउटपुट किंमत | $6.000 / 1M | $4.400 / 1M |
| एकूण इनपुट टोकन्स | 109,960 | 87,601 |
| आउटपुट टोकन्स | 5,124 | 6,006 |
| रिझनिंग टोकन्स | 32,924 | 57,661 |
| प्रतिसाद वेळ (सरासरी) | 14.55s | 27.82s |
| प्रतिसाद वेळ (कमाल) | 26.46s | 159.91s |
| प्रतिसाद वेळ (एकूण) | 320.17s | 612.06s |
| पॅरामीटर्स | ~1.7T एकूण (~170B सक्रिय) | 744B एकूण (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#96 SpaceXAI: Grok 4.6
low- खर्च
- $0.011
- वेळ
- 26.0s
- टोकन्स
- 1,941 tok
#99 GLM 5.3
high- खर्च
- $0.085
- वेळ
- 362.5s
- टोकन्स
- 19,310 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Claude Sonnet 4.6nonevsGLM 5.3highKAT-Coder-Pro V2.5lowvsGLM 5.3highQwen3.8 2.4T A95BhighvsGrok 4.6lowClaude Sonnet 4.6nonevsGrok 4.6lowGemini 3 Flash PreviewlowvsGLM 5.3highGemini 3.1 Flash LitemediumvsGLM 5.3highLongCat 2.0mediumvsGrok 4.6lowQwen3.7 PlusnonevsGLM 5.3highGPT-5.6 LunamediumvsGrok 4.6lowKimi K2.7 CodemediumvsGrok 4.6lowQwen3.7 MaxnonevsGrok 4.6lowDeepSeek V4 Flash 0731mediumvsGLM 5.3high