नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs GPT-5 Nano (medium)

average score लगभग बराबर है: 6.0 vs 6.1. GPT-5 Nano (medium) की benchmark लागत कम है: $0.114 vs $0.656. GPT-5 Nano (medium) तेज है: 54.87s vs 96.78s, pass rates 48.5% vs 56.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#145
कुल आउटपुट टोकन
815,220
प्रतिक्रिया समय (औसत)
96.78s
कुल लागत
$0.656
रैंक
#143
कुल आउटपुट टोकन
273,098
प्रतिक्रिया समय (औसत)
54.87s
कुल लागत
$0.114
अनुशंसित मॉडल GPT-5 Nano (medium)

It has the best score here (6.1), while costing about 5.8x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 GPT-5 Nano GPT-5 Nano medium रिलीज़: 2025-08-07
स्कोर 6.0 6.1
रैंक #145 #143
विश्वसनीयता 9.7 10.0
संगति 7.9 7.0
सही परीक्षण
प्रति प्रयास पास दर 48.5% 56.1%
अस्थिर टेस्ट 6 8
कुल रन 66 66
प्रति परिणाम लागत 8.199 1.267
कुल लागत $0.656 $0.114
इनपुट कीमत $0.220 / 1M $0.050 / 1M
आउटपुट कीमत $0.850 / 1M $0.400 / 1M
कुल इनपुट टोकन 122,845 94,935
आउटपुट टोकन 117,704 12,042
रीजनिंग टोकन 697,516 261,056
प्रतिक्रिया समय (औसत) 96.78s 54.87s
प्रतिक्रिया समय (अधिकतम) 540.96s 227.89s
प्रतिक्रिया समय (कुल) 2129.13s 822.99s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#143 GPT-5 Nano

medium
लागत
$0.006
समय
108.5s
टोकन
13,209 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

त्वरित तुलना

तुलना जोड़ी बदलें