- रैंक
- #127
- कुल आउटपुट टोकन
- 255,329
- प्रतिक्रिया समय (औसत)
- 63.19s
- कुल लागत
- $2.263
Grok 4.7 (low) vs GLM 5.1 (medium)
GLM 5.1 (medium) average score में आगे है: 7.5 vs 7.4. GLM 5.1 (medium) की benchmark लागत कम है: $1.066 vs $2.263. Grok 4.7 (low) तेज है: 63.19s vs 66.38s, pass rates 73.9% vs 66.7%.
तुलना किए गए मॉडल
- रैंक
- #119
- कुल आउटपुट टोकन
- 248,708
- प्रतिक्रिया समय (औसत)
- 66.38s
- कुल लागत
- $1.066
अनुशंसित मॉडल
GLM 5.1 (medium)
It has the best score here (7.5), while costing about 2.1x less than Grok 4.7 (low).
विस्तृत तुलना
| मेट्रिक | Grok 4.7 Grok 4.7 low | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| स्कोर | 7.4 | 7.5 |
| रैंक | #127 | #119 |
| विश्वसनीयता | 10.0 | 9.2 |
| संगति | 8.3 | 8.4 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 73.9% | 66.7% |
| अस्थिर टेस्ट | 5 | 4 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 13.804 | 9.004 |
| कुल लागत | $2.263 | $1.066 |
| इनपुट कीमत | $2.000 / 1M | $0.965 / 1M |
| आउटपुट कीमत | $6.000 / 1M | $3.032 / 1M |
| कुल इनपुट टोकन | 365,119 | 331,577 |
| आउटपुट टोकन | 8,118 | 17,919 |
| रीजनिंग टोकन | 247,211 | 230,789 |
| प्रतिक्रिया समय (औसत) | 63.19s | 66.38s |
| प्रतिक्रिया समय (अधिकतम) | 389.63s | 308.75s |
| प्रतिक्रिया समय (कुल) | 1453.28s | 1460.31s |
| पैरामीटर | ~1.7T कुल (~170B सक्रिय) | 744B कुल (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | मुक्त स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#127 SpaceXAI: Grok 4.7
low- लागत
- $0.007
- समय
- 15.2s
- टोकन
- 1,537 tok
#119 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- लागत
- $0.000
- समय
- 300.0s
- टोकन
- 0 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Space Bunny AlphahighvsGLM 5.1mediumGrok 4.7lowvsGLM 5.3 FlashXhighSeed-2.0-CodemediumvsGrok 4.7lowInkling Smallhighनिःशुल्क उपलब्धvsGrok 4.7lowQwen3.6 FlashmediumvsGrok 4.7lowGPT-5.6 LunamediumvsGrok 4.7lowQwen3.8 27Blowनिःशुल्क उपलब्धvsGLM 5.1mediumGPT-6 LunalowvsGLM 5.1mediumDeepSeek V4 Pro 0423nonevsGrok 4.7lowInklingmediumनिःशुल्क उपलब्धvsGrok 4.7lowGemma 4 26B A4Bmediumनिःशुल्क उपलब्धvsGrok 4.7lowSeed-2.0-CodehighvsGLM 5.1medium