नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs GLM 5.1 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.524 vs $0.727. GPT-5.6 Sol वेगवान आहे: 2.17s vs 58.80s, pass rates 63.6% vs 65.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#115
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.17s
एकूण खर्च
$0.524
क्रमांक
#117
एकूण आउटपुट टोकन्स
215,889
प्रतिसाद वेळ (सरासरी)
58.80s
एकूण खर्च
$0.727
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (7.0), while responding about 27.1x faster than GLM 5.1 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09 GLM 5.1 GLM 5.1 medium प्रकाशन: 2026-04-07
स्कोअर 7.0 7.0
क्रमांक #115 #117
विश्वसनीयता 10.0 8.1
सुसंगतता 9.0 8.4
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 65.2%
अस्थिर चाचण्या 3 4
एकूण रन 66 66
प्रति निकाल खर्च 4.365 6.923
एकूण खर्च $0.524 $0.727
इनपुट किंमत $5.000 / 1M $0.966 / 1M
आउटपुट किंमत $30.000 / 1M $3.036 / 1M
एकूण इनपुट टोकन्स 78,602 82,592
आउटपुट टोकन्स 4,357 16,089
रिझनिंग टोकन्स 0 199,800
प्रतिसाद वेळ (सरासरी) 2.17s 58.80s
प्रतिसाद वेळ (कमाल) 12.81s 308.75s
प्रतिसाद वेळ (एकूण) 47.66s 1234.72s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

#117 GLM 5.1

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

झटपट तुलना

तुलना जोडी बदला