नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs GLM 4.7 Flash (medium)

Trinity Large Thinking (high) average score में आगे है: 4.8 vs 4.3. GLM 4.7 Flash (medium) की benchmark लागत कम है: $0.166 vs $0.632. Trinity Large Thinking (high) तेज है: 77.22s vs 142.59s, pass rates 39.4% vs 31.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#217
कुल आउटपुट टोकन
417,863
प्रतिक्रिया समय (औसत)
142.59s
कुल लागत
$0.166
अनुशंसित मॉडल Trinity Large Thinking (high)

It has the best score here (4.8), while responding about 1.8x faster than GLM 4.7 Flash (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 GLM 4.7 Flash GLM 4.7 Flash medium रिलीज़: 2026-01-19
स्कोर 4.8 4.3
रैंक #202 #217
विश्वसनीयता 9.9 7.8
संगति 7.2 7.0
सही परीक्षण
प्रति प्रयास पास दर 39.4% 31.8%
अस्थिर टेस्ट 8 8
कुल रन 66 66
प्रति परिणाम लागत 12.640 4.147
कुल लागत $0.632 $0.166
इनपुट कीमत $0.220 / 1M $0.060 / 1M
आउटपुट कीमत $0.850 / 1M $0.400 / 1M
कुल इनपुट टोकन 101,767 79,051
आउटपुट टोकन 286,218 43,754
रीजनिंग टोकन 667,540 374,109
प्रतिक्रिया समय (औसत) 77.22s 142.59s
प्रतिक्रिया समय (अधिकतम) 510.21s 1539.97s
प्रतिक्रिया समय (कुल) 1698.89s 1996.21s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#217 GLM 4.7 Flash

medium
अमान्य SVG
लागत
$0.000
समय
186.2s
टोकन
12,112 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

त्वरित तुलना

तुलना जोड़ी बदलें