नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.6 Terra

average score जवळपास समान आहे: 6.0 vs 6.0. GPT-5.6 Terra चा benchmark खर्च कमी आहे: $0.175 vs $0.792. GPT-5.6 Terra वेगवान आहे: 1.65s vs 84.96s, pass rates 45.5% vs 42.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#150
एकूण आउटपुट टोकन्स
1,002,646
प्रतिसाद वेळ (सरासरी)
84.96s
एकूण खर्च
$0.792
क्रमांक
#148
एकूण आउटपुट टोकन्स
6,203
प्रतिसाद वेळ (सरासरी)
1.65s
एकूण खर्च
$0.175
शिफारस केलेले मॉडेल GPT-5.6 Terra

It has the best score here (6.0), while costing about 4.5x less than Trinity Large Thinking (medium).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium प्रकाशन: 2026-07-28 GPT-5.6 Terra GPT-5.6 Terra none प्रकाशन: 2026-07-09
स्कोअर 6.0 6.0
क्रमांक #150 #148
विश्वसनीयता 10.0 10.0
सुसंगतता 7.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 42.4%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 11.308 4.359
एकूण खर्च $0.792 $0.175
इनपुट किंमत $0.220 / 1M $1.250 / 1M
आउटपुट किंमत $0.850 / 1M $7.500 / 1M
एकूण इनपुट टोकन्स 118,477 102,259
आउटपुट टोकन्स 148,823 6,203
रिझनिंग टोकन्स 853,823 0
प्रतिसाद वेळ (सरासरी) 84.96s 1.65s
प्रतिसाद वेळ (कमाल) 525.14s 10.07s
प्रतिसाद वेळ (एकूण) 1869.16s 36.28s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
खर्च
$0.016
वेळ
75.9s
टोकन्स
19,401 tok

#148 GPT-5.6 Terra

none
खर्च
$0.030
वेळ
14.7s
टोकन्स
2,082 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.6 Terra 5.5 10.0 33.3% 0 1.00s 7,302 336 0

झटपट तुलना

तुलना जोडी बदला