नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GLM 5

Trinity Large Thinking (high) average score मध्ये पुढे आहे: 5.7 vs 5.6. GLM 5 चा benchmark खर्च कमी आहे: $0.140 vs $0.794. GLM 5 वेगवान आहे: 8.74s vs 74.52s, pass rates 42.0% vs 40.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#253
एकूण आउटपुट टोकन्स
943,044
प्रतिसाद वेळ (सरासरी)
74.52s
एकूण खर्च
$0.794
क्रमांक
#262
एकूण आउटपुट टोकन्स
5,577
प्रतिसाद वेळ (सरासरी)
8.74s
एकूण खर्च
$0.140
शिफारस केलेले मॉडेल GLM 5

Its score stays close to the best score here (5.6 vs 5.7), while costing about 5.7x less than Trinity Large Thinking (high).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 GLM 5 GLM 5 none प्रकाशन: 2026-02-12
स्कोअर 5.7 5.6
क्रमांक #253 #262
विश्वसनीयता 10.0 10.0
सुसंगतता 7.3 9.3
प्रयत्न 69/69 66/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 42.0% 40.6%
अस्थिर चाचण्या 8 1
एकूण रन 69 66
प्रति निकाल खर्च 11.289 1.363
एकूण खर्च $0.794 $0.140
इनपुट किंमत $0.250 / 1M $0.600 / 1M
आउटपुट किंमत $0.800 / 1M $1.920 / 1M
कॅश वाचण्याची किंमत $0.060 / 1M $0.120 / 1M
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 283,116 190,675
आउटपुट टोकन्स 277,920 5,577
रिझनिंग टोकन्स 665,124 0
प्रतिसाद वेळ (सरासरी) 74.52s 8.74s
प्रतिसाद वेळ (कमाल) 510.21s 74.80s
प्रतिसाद वेळ (एकूण) 1713.90s 131.17s
पॅरामीटर्स 398B एकूण (13B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#253 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#262 GLM 5

none
खर्च
$0.007
वेळ
32.1s
टोकन्स
2,023 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

झटपट तुलना

तुलना जोडी बदला