नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GPT-4o-mini

GPT-4o-mini average score में आगे है: 5.0 vs 4.8. GPT-4o-mini की benchmark लागत कम है: $0.010 vs $0.632. GPT-4o-mini तेज है: 1.99s vs 77.22s, pass rates 39.4% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#195
कुल आउटपुट टोकन
2,911
प्रतिक्रिया समय (औसत)
1.99s
कुल लागत
$0.010
अनुशंसित मॉडल GPT-4o-mini

It has the best score here (5.0), while costing about 65.0x less than Trinity Large Thinking (high).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18
स्कोर 4.8 5.0
रैंक #202 #195
विश्वसनीयता 9.9 10.0
संगति 7.2 9.9
सही परीक्षण
प्रति प्रयास पास दर 39.4% 22.7%
अस्थिर टेस्ट 8 0
कुल रन 66 66
प्रति परिणाम लागत 12.640 0.195
कुल लागत $0.632 $0.010
इनपुट कीमत $0.220 / 1M $0.150 / 1M
आउटपुट कीमत $0.850 / 1M $0.600 / 1M
कुल इनपुट टोकन 101,767 53,136
आउटपुट टोकन 286,218 2,911
रीजनिंग टोकन 667,540 0
प्रतिक्रिया समय (औसत) 77.22s 1.99s
प्रतिक्रिया समय (अधिकतम) 510.21s 7.58s
प्रतिक्रिया समय (कुल) 1698.89s 29.86s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#195 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

त्वरित तुलना

तुलना जोड़ी बदलें