नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.6 Terra

average score लगभग बराबर है: 6.0 vs 6.0. GPT-5.6 Terra की benchmark लागत कम है: $0.175 vs $0.792. GPT-5.6 Terra तेज है: 1.65s vs 84.96s, pass rates 45.5% vs 42.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#150
कुल आउटपुट टोकन
1,002,646
प्रतिक्रिया समय (औसत)
84.96s
कुल लागत
$0.792
रैंक
#148
कुल आउटपुट टोकन
6,203
प्रतिक्रिया समय (औसत)
1.65s
कुल लागत
$0.175
अनुशंसित मॉडल GPT-5.6 Terra

It has the best score here (6.0), while costing about 4.5x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 GPT-5.6 Terra GPT-5.6 Terra none रिलीज़: 2026-07-09
स्कोर 6.0 6.0
रैंक #150 #148
विश्वसनीयता 10.0 10.0
संगति 7.6 8.9
सही परीक्षण
प्रति प्रयास पास दर 45.5% 42.4%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 11.308 4.359
कुल लागत $0.792 $0.175
इनपुट कीमत $0.220 / 1M $1.250 / 1M
आउटपुट कीमत $0.850 / 1M $7.500 / 1M
कुल इनपुट टोकन 118,477 102,259
आउटपुट टोकन 148,823 6,203
रीजनिंग टोकन 853,823 0
प्रतिक्रिया समय (औसत) 84.96s 1.65s
प्रतिक्रिया समय (अधिकतम) 525.14s 10.07s
प्रतिक्रिया समय (कुल) 1869.16s 36.28s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#148 GPT-5.6 Terra

none
लागत
$0.030
समय
14.7s
टोकन
2,082 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.6 Terra 5.5 10.0 33.3% 0 1.00s 7,302 336 0

त्वरित तुलना

तुलना जोड़ी बदलें