नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs Cobuddy (medium)

Trinity Large Thinking (high) average score में आगे है: 4.8 vs 4.7. Cobuddy (medium) की benchmark लागत कम है: $0.000 vs $0.632. Cobuddy (medium) तेज है: 39.90s vs 77.22s, pass rates 39.4% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#210
कुल आउटपुट टोकन
118,380
प्रतिक्रिया समय (औसत)
39.90s
कुल लागत
$0.000
अनुशंसित मॉडल Trinity Large Thinking (high)

It has the strongest score in this comparison (4.8) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 Cobuddy Cobuddy medium रिलीज़: 2026-05-06
स्कोर 4.8 4.7
रैंक #202 #210
विश्वसनीयता 9.9 10.0
संगति 7.2 7.2
सही परीक्षण
प्रति प्रयास पास दर 39.4% 45.5%
अस्थिर टेस्ट 8 6
कुल रन 66 63
प्रति परिणाम लागत 12.640 0.000
कुल लागत $0.632 $0.000
इनपुट कीमत $0.220 / 1M $0.000 / 1M
आउटपुट कीमत $0.850 / 1M $0.000 / 1M
कुल इनपुट टोकन 101,767 37,449
आउटपुट टोकन 286,218 1,677
रीजनिंग टोकन 667,540 116,703
प्रतिक्रिया समय (औसत) 77.22s 39.90s
प्रतिक्रिया समय (अधिकतम) 510.21s 309.02s
प्रतिक्रिया समय (कुल) 1698.89s 797.98s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#210 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
लागत
$0.000
समय
0.1s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138

त्वरित तुलना

तुलना जोड़ी बदलें