नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.4 Mini

Trinity Large Thinking (medium) average score मध्ये पुढे आहे: 6.0 vs 5.9. GPT-5.4 Mini चा benchmark खर्च कमी आहे: $0.095 vs $0.792. GPT-5.4 Mini वेगवान आहे: 1.53s vs 84.96s, pass rates 45.5% vs 33.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#150
एकूण आउटपुट टोकन्स
1,002,646
प्रतिसाद वेळ (सरासरी)
84.96s
एकूण खर्च
$0.792
क्रमांक
#153
एकूण आउटपुट टोकन्स
7,880
प्रतिसाद वेळ (सरासरी)
1.53s
एकूण खर्च
$0.095
शिफारस केलेले मॉडेल GPT-5.4 Mini

Its score stays close to the best score here (5.9 vs 6.0), while costing about 8.4x less than Trinity Large Thinking (medium).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium प्रकाशन: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none प्रकाशन: 2026-03-17
स्कोअर 6.0 5.9
क्रमांक #150 #153
विश्वसनीयता 10.0 10.0
सुसंगतता 7.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 33.3%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 11.308 1.580
एकूण खर्च $0.792 $0.095
इनपुट किंमत $0.220 / 1M $0.750 / 1M
आउटपुट किंमत $0.850 / 1M $4.500 / 1M
एकूण इनपुट टोकन्स 118,477 79,067
आउटपुट टोकन्स 148,823 7,880
रिझनिंग टोकन्स 853,823 0
प्रतिसाद वेळ (सरासरी) 84.96s 1.53s
प्रतिसाद वेळ (कमाल) 525.14s 9.92s
प्रतिसाद वेळ (एकूण) 1869.16s 33.74s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
खर्च
$0.016
वेळ
75.9s
टोकन्स
19,401 tok

#153 GPT-5.4 Mini

none
खर्च
$0.010
वेळ
11.7s
टोकन्स
2,151 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

झटपट तुलना

तुलना जोडी बदला