नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6.1 Sol (low) vs GLM 5.3 (high)

GPT-6.1 Sol (low) average score में आगे है: 9.6 vs 7.8. GPT-6.1 Sol (low) की benchmark लागत कम है: $0.460 vs $0.610. GPT-6.1 Sol (low) तेज है: 7.15s vs 28.38s, pass rates 92.8% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-03

तुलना किए गए मॉडल

रैंक
#16
कुल आउटपुट टोकन
13,138
प्रतिक्रिया समय (औसत)
7.15s
कुल लागत
$0.460
रैंक
#107
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल GPT-6.1 Sol (low)

It has the best score here (9.6), while responding about 4.0x faster than GLM 5.3 (high).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 9.6 7.8
रैंक #16 #107
विश्वसनीयता 10.0 10.0
संगति 9.6 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 92.8% 75.4%
अस्थिर टेस्ट 1 7
कुल रन 69 69
प्रति परिणाम लागत 2.187 4.351
कुल लागत $0.460 $0.610
इनपुट कीमत $2.000 / 1M $1.400 / 1M
आउटपुट कीमत $10.000 / 1M $4.400 / 1M
कैश पढ़ने की कीमत $0.100 / 1M $0.140 / 1M
कैश लिखने की कीमत $2.500 / 1M लागू नहीं
कुल इनपुट टोकन 163,900 219,811
आउटपुट टोकन 4,958 8,811
रीजनिंग टोकन 8,180 59,671
प्रतिक्रिया समय (औसत) 7.15s 28.38s
प्रतिक्रिया समय (अधिकतम) 46.57s 159.91s
प्रतिक्रिया समय (कुल) 164.47s 652.78s
पैरामीटर ~2T कुल (~150B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

#107 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें