नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GPT-5.4 Nano

average score लगभग बराबर है: 4.8 vs 4.8. GPT-5.4 Nano की benchmark लागत कम है: $0.041 vs $0.632. GPT-5.4 Nano तेज है: 2.57s vs 77.22s, pass rates 39.4% vs 28.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#201
कुल आउटपुट टोकन
13,794
प्रतिक्रिया समय (औसत)
2.57s
कुल लागत
$0.041
अनुशंसित मॉडल GPT-5.4 Nano

It has the best score here (4.8), while costing about 15.6x less than Trinity Large Thinking (high).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17
स्कोर 4.8 4.8
रैंक #202 #201
विश्वसनीयता 9.9 10.0
संगति 7.2 8.2
सही परीक्षण
प्रति प्रयास पास दर 39.4% 28.8%
अस्थिर टेस्ट 8 5
कुल रन 66 66
प्रति परिणाम लागत 12.640 1.011
कुल लागत $0.632 $0.041
इनपुट कीमत $0.220 / 1M $0.200 / 1M
आउटपुट कीमत $0.850 / 1M $1.250 / 1M
कुल इनपुट टोकन 101,767 115,924
आउटपुट टोकन 286,218 13,794
रीजनिंग टोकन 667,540 0
प्रतिक्रिया समय (औसत) 77.22s 2.57s
प्रतिक्रिया समय (अधिकतम) 510.21s 25.50s
प्रतिक्रिया समय (कुल) 1698.89s 56.51s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#201 GPT-5.4 Nano

none
लागत
$0.008
समय
46.1s
टोकन
5,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

त्वरित तुलना

तुलना जोड़ी बदलें