नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.4

Trinity Large Thinking (medium) average score में आगे है: 6.0 vs 5.8. GPT-5.4 की benchmark लागत कम है: $0.397 vs $0.792. GPT-5.4 तेज है: 2.07s vs 84.96s, pass rates 45.5% vs 34.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#150
कुल आउटपुट टोकन
1,002,646
प्रतिक्रिया समय (औसत)
84.96s
कुल लागत
$0.792
रैंक
#156
कुल आउटपुट टोकन
8,321
प्रतिक्रिया समय (औसत)
2.07s
कुल लागत
$0.397
अनुशंसित मॉडल GPT-5.4

Its score stays close to the best score here (5.8 vs 6.0), while costing about 2.0x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 GPT-5.4 GPT-5.4 none रिलीज़: 2026-03-05
स्कोर 6.0 5.8
रैंक #150 #156
विश्वसनीयता 10.0 10.0
संगति 7.6 9.2
सही परीक्षण
प्रति प्रयास पास दर 45.5% 34.9%
अस्थिर टेस्ट 7 2
कुल रन 66 66
प्रति परिणाम लागत 11.308 5.663
कुल लागत $0.792 $0.397
इनपुट कीमत $0.220 / 1M $2.500 / 1M
आउटपुट कीमत $0.850 / 1M $15.000 / 1M
कुल इनपुट टोकन 118,477 108,632
आउटपुट टोकन 148,823 8,321
रीजनिंग टोकन 853,823 0
प्रतिक्रिया समय (औसत) 84.96s 2.07s
प्रतिक्रिया समय (अधिकतम) 525.14s 15.63s
प्रतिक्रिया समय (कुल) 1869.16s 45.51s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#156 GPT-5.4

none
लागत
$0.026
समय
18.1s
टोकन
1,792 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0

त्वरित तुलना

तुलना जोड़ी बदलें