नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs Granite 4.1 8B

Trinity Large Thinking (high) average score मध्ये पुढे आहे: 4.8 vs 4.0. Granite 4.1 8B चा benchmark खर्च कमी आहे: $0.007 vs $0.632. Granite 4.1 8B वेगवान आहे: 1.45s vs 77.22s, pass rates 39.4% vs 9.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#202
एकूण आउटपुट टोकन्स
953,758
प्रतिसाद वेळ (सरासरी)
77.22s
एकूण खर्च
$0.632
क्रमांक
#224
एकूण आउटपुट टोकन्स
5,996
प्रतिसाद वेळ (सरासरी)
1.45s
एकूण खर्च
$0.007
शिफारस केलेले मॉडेल Granite 4.1 8B

Its score stays close to the best score here (4.0 vs 4.8), while costing about 100.5x less than Trinity Large Thinking (high).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 Granite 4.1 8B Granite 4.1 8B none प्रकाशन: 2026-05-01
स्कोअर 4.8 4.0
क्रमांक #202 #224
विश्वसनीयता 9.9 10.0
सुसंगतता 7.2 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 39.4% 9.1%
अस्थिर चाचण्या 8 0
एकूण रन 66 66
प्रति निकाल खर्च 12.640 0.315
एकूण खर्च $0.632 $0.007
इनपुट किंमत $0.220 / 1M $0.050 / 1M
आउटपुट किंमत $0.850 / 1M $0.100 / 1M
एकूण इनपुट टोकन्स 101,767 113,827
आउटपुट टोकन्स 286,218 5,996
रिझनिंग टोकन्स 667,540 0
प्रतिसाद वेळ (सरासरी) 77.22s 1.45s
प्रतिसाद वेळ (कमाल) 510.21s 16.67s
प्रतिसाद वेळ (एकूण) 1698.89s 31.96s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#224 IBM: Granite 4.1 8B

none
खर्च
$0.001
वेळ
3.2s
टोकन्स
491 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0

झटपट तुलना

तुलना जोडी बदला