- रैंक
- #107
- कुल आउटपुट टोकन
- 266,197
- प्रतिक्रिया समय (औसत)
- 74.77s
- कुल लागत
- $2.270
Grok 4.6 (medium) vs GLM 5.3 (high)
average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.3 (high) की benchmark लागत कम है: $0.610 vs $2.270. GLM 5.3 (high) तेज है: 28.38s vs 74.77s, pass rates 78.3% vs 75.4%.
तुलना किए गए मॉडल
- रैंक
- #105
- कुल आउटपुट टोकन
- 68,482
- प्रतिक्रिया समय (औसत)
- 28.38s
- कुल लागत
- $0.610
अनुशंसित मॉडल
GLM 5.3 (high)
It has the best score here (7.8), while costing about 3.7x less than Grok 4.6 (medium).
विस्तृत तुलना
| मेट्रिक | Grok 4.6 Grok 4.6 medium | GLM 5.3 GLM 5.3 high |
|---|---|---|
| स्कोर | 7.8 | 7.8 |
| रैंक | #107 | #105 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.7 | 7.6 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 78.3% | 75.4% |
| अस्थिर टेस्ट | 4 | 7 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 14.187 | 4.351 |
| कुल लागत | $2.270 | $0.610 |
| इनपुट कीमत | $2.000 / 1M | $1.400 / 1M |
| आउटपुट कीमत | $6.000 / 1M | $4.400 / 1M |
| कुल इनपुट टोकन | 336,351 | 219,811 |
| आउटपुट टोकन | 6,180 | 8,811 |
| रीजनिंग टोकन | 260,017 | 59,671 |
| प्रतिक्रिया समय (औसत) | 74.77s | 28.38s |
| प्रतिक्रिया समय (अधिकतम) | 514.35s | 159.91s |
| प्रतिक्रिया समय (कुल) | 1719.73s | 652.78s |
| पैरामीटर | ~1.7T कुल (~170B सक्रिय) | 744B कुल (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#107 SpaceXAI: Grok 4.6
medium- लागत
- $0.028
- समय
- 72.1s
- टोकन
- 4,771 tok
#105 GLM 5.3
high- लागत
- $0.085
- समय
- 362.5s
- टोकन
- 19,310 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Grok 4.5mediumvsGLM 5.3highStep 3.7 FlashmediumvsGLM 5.3highQwen3.7 PlusnonevsGrok 4.6mediumMiMo-V2.6-FlashmediumvsGLM 5.3highQwen3.7 PlusnonevsGLM 5.3highGemini 3.5 FlashmediumvsGLM 5.3highGrok 4.5lowvsGLM 5.3highDeepSeek V4 Flash 0731mediumvsGLM 5.3highQwen3.8 2.4T A95BhighvsGrok 4.6mediumQwen3.7 MaxnonevsGLM 5.3highGPT-6 LunahighvsGrok 4.6mediumMuse Glimmer 30BhighvsGrok 4.6medium