नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs GPT-5.4 Mini

Trinity Large Thinking (low) average score में आगे है: 6.0 vs 5.9. GPT-5.4 Mini की benchmark लागत कम है: $0.095 vs $0.656. GPT-5.4 Mini तेज है: 1.53s vs 96.78s, pass rates 48.5% vs 33.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#145
कुल आउटपुट टोकन
815,220
प्रतिक्रिया समय (औसत)
96.78s
कुल लागत
$0.656
रैंक
#153
कुल आउटपुट टोकन
7,880
प्रतिक्रिया समय (औसत)
1.53s
कुल लागत
$0.095
अनुशंसित मॉडल GPT-5.4 Mini

Its score stays close to the best score here (5.9 vs 6.0), while costing about 6.9x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none रिलीज़: 2026-03-17
स्कोर 6.0 5.9
रैंक #145 #153
विश्वसनीयता 9.7 10.0
संगति 7.9 8.9
सही परीक्षण
प्रति प्रयास पास दर 48.5% 33.3%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 8.199 1.580
कुल लागत $0.656 $0.095
इनपुट कीमत $0.220 / 1M $0.750 / 1M
आउटपुट कीमत $0.850 / 1M $4.500 / 1M
कुल इनपुट टोकन 122,845 79,067
आउटपुट टोकन 117,704 7,880
रीजनिंग टोकन 697,516 0
प्रतिक्रिया समय (औसत) 96.78s 1.53s
प्रतिक्रिया समय (अधिकतम) 540.96s 9.92s
प्रतिक्रिया समय (कुल) 2129.13s 33.74s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#153 GPT-5.4 Mini

none
लागत
$0.010
समय
11.7s
टोकन
2,151 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

त्वरित तुलना

तुलना जोड़ी बदलें