नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs GPT-5 Nano (medium)

average score जवळपास समान आहे: 6.0 vs 6.1. GPT-5 Nano (medium) चा benchmark खर्च कमी आहे: $0.114 vs $0.656. GPT-5 Nano (medium) वेगवान आहे: 54.87s vs 96.78s, pass rates 48.5% vs 56.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#145
एकूण आउटपुट टोकन्स
815,220
प्रतिसाद वेळ (सरासरी)
96.78s
एकूण खर्च
$0.656
क्रमांक
#143
एकूण आउटपुट टोकन्स
273,098
प्रतिसाद वेळ (सरासरी)
54.87s
एकूण खर्च
$0.114
शिफारस केलेले मॉडेल GPT-5 Nano (medium)

It has the best score here (6.1), while costing about 5.8x less than Trinity Large Thinking (low).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low प्रकाशन: 2026-07-28 GPT-5 Nano GPT-5 Nano medium प्रकाशन: 2025-08-07
स्कोअर 6.0 6.1
क्रमांक #145 #143
विश्वसनीयता 9.7 10.0
सुसंगतता 7.9 7.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 48.5% 56.1%
अस्थिर चाचण्या 6 8
एकूण रन 66 66
प्रति निकाल खर्च 8.199 1.267
एकूण खर्च $0.656 $0.114
इनपुट किंमत $0.220 / 1M $0.050 / 1M
आउटपुट किंमत $0.850 / 1M $0.400 / 1M
एकूण इनपुट टोकन्स 122,845 94,935
आउटपुट टोकन्स 117,704 12,042
रिझनिंग टोकन्स 697,516 261,056
प्रतिसाद वेळ (सरासरी) 96.78s 54.87s
प्रतिसाद वेळ (कमाल) 540.96s 227.89s
प्रतिसाद वेळ (एकूण) 2129.13s 822.99s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
खर्च
$0.021
वेळ
173.2s
टोकन्स
24,586 tok

#143 GPT-5 Nano

medium
खर्च
$0.006
वेळ
108.5s
टोकन्स
13,209 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

झटपट तुलना

तुलना जोडी बदला