नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash (low) vs GLM 5.2 (medium)

Gemini 3.5 Flash (low) average score में आगे है: 8.8 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.224 vs $0.449. Gemini 3.5 Flash (low) तेज है: 5.76s vs 23.28s, pass rates 84.9% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#24
कुल आउटपुट टोकन
35,195
प्रतिक्रिया समय (औसत)
5.76s
कुल लागत
$0.449
रैंक
#65
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.224
अनुशंसित मॉडल Gemini 3.5 Flash (low)

It has the best score here (8.8), while responding about 4.0x faster than GLM 5.2 (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash low रिलीज़: 2026-05-19 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 8.8 7.8
रैंक #24 #65
विश्वसनीयता 10.0 9.5
संगति 9.3 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 84.9% 80.3%
अस्थिर टेस्ट 2 4
कुल रन 66 63
प्रति परिणाम लागत 2.492 2.159
कुल लागत $0.449 $0.224
इनपुट कीमत $1.500 / 1M $0.966 / 1M
आउटपुट कीमत $9.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 87,826 37,199
आउटपुट टोकन 2,239 12,261
रीजनिंग टोकन 32,956 49,500
प्रतिक्रिया समय (औसत) 5.76s 23.28s
प्रतिक्रिया समय (अधिकतम) 53.55s 101.36s
प्रतिक्रिया समय (कुल) 126.71s 488.94s
पैरामीटर ~500B कुल (~20B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Gemini 3.5 Flash

low
लागत
$0.068
समय
39.1s
टोकन
7,588 tok

#65 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 7.8 10.0 66.7% 0 6.71s 8,118 458 13,420
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Qwen3.8 27BlowvsGLM 5.2mediumClaude Opus 4.8mediumvsGemini 3.5 FlashlowGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumSeed 2.1 TurbohighvsGemini 3.5 FlashlowQwen3.7 FlashhighvsGLM 5.2mediumClaude Opus 4.7mediumvsGemini 3.5 FlashlowGPT-5.6 TerrahighvsGLM 5.2mediumGemini 3.5 FlashlowvsGPT-5.3-CodexmediumSeed-2.0-CodelowvsGLM 5.2mediumGemini 3.5 FlashlowvsMuse Spark 1.2high