नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs GPT-5.6 Terra

Trinity Large Thinking (low) average score मध्ये पुढे आहे: 6.0 vs 6.0. GPT-5.6 Terra चा benchmark खर्च कमी आहे: $0.175 vs $0.656. GPT-5.6 Terra वेगवान आहे: 1.65s vs 96.78s, pass rates 48.5% vs 42.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#145
एकूण आउटपुट टोकन्स
815,220
प्रतिसाद वेळ (सरासरी)
96.78s
एकूण खर्च
$0.656
क्रमांक
#148
एकूण आउटपुट टोकन्स
6,203
प्रतिसाद वेळ (सरासरी)
1.65s
एकूण खर्च
$0.175
शिफारस केलेले मॉडेल GPT-5.6 Terra

Its score stays close to the best score here (6.0 vs 6.0), while costing about 3.8x less than Trinity Large Thinking (low).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low प्रकाशन: 2026-07-28 GPT-5.6 Terra GPT-5.6 Terra none प्रकाशन: 2026-07-09
स्कोअर 6.0 6.0
क्रमांक #145 #148
विश्वसनीयता 9.7 10.0
सुसंगतता 7.9 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 48.5% 42.4%
अस्थिर चाचण्या 6 3
एकूण रन 66 66
प्रति निकाल खर्च 8.199 4.359
एकूण खर्च $0.656 $0.175
इनपुट किंमत $0.220 / 1M $1.250 / 1M
आउटपुट किंमत $0.850 / 1M $7.500 / 1M
एकूण इनपुट टोकन्स 122,845 102,259
आउटपुट टोकन्स 117,704 6,203
रिझनिंग टोकन्स 697,516 0
प्रतिसाद वेळ (सरासरी) 96.78s 1.65s
प्रतिसाद वेळ (कमाल) 540.96s 10.07s
प्रतिसाद वेळ (एकूण) 2129.13s 36.28s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
खर्च
$0.021
वेळ
173.2s
टोकन्स
24,586 tok

#148 GPT-5.6 Terra

none
खर्च
$0.030
वेळ
14.7s
टोकन्स
2,082 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5.6 Terra 5.5 10.0 33.3% 0 1.00s 7,302 336 0

झटपट तुलना

तुलना जोडी बदला