नेविगेशन
Advertise here

Trinity Large Thinking (high) vs GPT-5.4 Nano

average score लगभग बराबर है: 4.8 vs 4.8. GPT-5.4 Nano की benchmark लागत कम है: $0.041 vs $0.592. GPT-5.4 Nano तेज है: 2.56s vs 75.86s, pass rates 39.4% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#288
कुल आउटपुट टोकन
932,619
प्रतिक्रिया समय (औसत)
75.86s
कुल लागत
$0.592
रैंक
#287
कुल आउटपुट टोकन
13,794
प्रतिक्रिया समय (औसत)
2.56s
कुल लागत
$0.041
अनुशंसित मॉडल GPT-5.4 Nano

It has the best score here (4.8), while costing about 14.6x less than Trinity Large Thinking (high).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17
स्कोर 4.8 4.8
रैंक #288 #287
विश्वसनीयता 10.0 10.0
संगति 7.2 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 39.4% 27.3%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 12.473 1.011
कुल लागत $0.592 $0.041
इनपुट कीमत $0.250 / 1M $0.200 / 1M
आउटपुट कीमत $0.800 / 1M $1.250 / 1M
कुल इनपुट टोकन 101,776 115,933
आउटपुट टोकन 276,367 13,794
रीजनिंग टोकन 656,252 0
प्रतिक्रिया समय (औसत) 75.86s 2.56s
प्रतिक्रिया समय (अधिकतम) 510.21s 25.50s
प्रतिक्रिया समय (कुल) 1668.93s 56.37s
पैरामीटर 398B कुल (13B सक्रिय) ~120B कुल (~5B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#287 GPT-5.4 Nano

none
लागत
$0.008
समय
46.1s
टोकन
5,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

त्वरित तुलना

तुलना जोड़ी बदलें