नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs GLM 4.7 Flash

GLM 4.7 Flash average score मध्ये पुढे आहे: 4.9 vs 4.8. GLM 4.7 Flash चा benchmark खर्च कमी आहे: $0.016 vs $0.632. GLM 4.7 Flash वेगवान आहे: 9.15s vs 77.22s, pass rates 39.4% vs 34.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#202
एकूण आउटपुट टोकन्स
953,758
प्रतिसाद वेळ (सरासरी)
77.22s
एकूण खर्च
$0.632
क्रमांक
#197
एकूण आउटपुट टोकन्स
22,992
प्रतिसाद वेळ (सरासरी)
9.15s
एकूण खर्च
$0.016
शिफारस केलेले मॉडेल GLM 4.7 Flash

It has the best score here (4.9), while costing about 41.3x less than Trinity Large Thinking (high).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 GLM 4.7 Flash GLM 4.7 Flash none प्रकाशन: 2026-01-19
स्कोअर 4.8 4.9
क्रमांक #202 #197
विश्वसनीयता 9.9 10.0
सुसंगतता 7.2 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 39.4% 34.9%
अस्थिर चाचण्या 8 3
एकूण रन 66 66
प्रति निकाल खर्च 12.640 0.256
एकूण खर्च $0.632 $0.016
इनपुट किंमत $0.220 / 1M $0.060 / 1M
आउटपुट किंमत $0.850 / 1M $0.400 / 1M
एकूण इनपुट टोकन्स 101,767 101,504
आउटपुट टोकन्स 286,218 22,992
रिझनिंग टोकन्स 667,540 0
प्रतिसाद वेळ (सरासरी) 77.22s 9.15s
प्रतिसाद वेळ (कमाल) 510.21s 97.15s
प्रतिसाद वेळ (एकूण) 1698.89s 137.18s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#197 GLM 4.7 Flash

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GLM 4.7 Flash 4.3 10.0 0.0% 0 2.54s 7,256 650 0

झटपट तुलना

तुलना जोडी बदला