नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs Granite 4.1 8B

Trinity Large Thinking (high) average score में आगे है: 4.8 vs 4.0. Granite 4.1 8B की benchmark लागत कम है: $0.007 vs $0.632. Granite 4.1 8B तेज है: 1.45s vs 77.22s, pass rates 39.4% vs 9.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#224
कुल आउटपुट टोकन
5,996
प्रतिक्रिया समय (औसत)
1.45s
कुल लागत
$0.007
अनुशंसित मॉडल Granite 4.1 8B

Its score stays close to the best score here (4.0 vs 4.8), while costing about 100.5x less than Trinity Large Thinking (high).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01
स्कोर 4.8 4.0
रैंक #202 #224
विश्वसनीयता 9.9 10.0
संगति 7.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 39.4% 9.1%
अस्थिर टेस्ट 8 0
कुल रन 66 66
प्रति परिणाम लागत 12.640 0.315
कुल लागत $0.632 $0.007
इनपुट कीमत $0.220 / 1M $0.050 / 1M
आउटपुट कीमत $0.850 / 1M $0.100 / 1M
कुल इनपुट टोकन 101,767 113,827
आउटपुट टोकन 286,218 5,996
रीजनिंग टोकन 667,540 0
प्रतिक्रिया समय (औसत) 77.22s 1.45s
प्रतिक्रिया समय (अधिकतम) 510.21s 16.67s
प्रतिक्रिया समय (कुल) 1698.89s 31.96s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#224 IBM: Granite 4.1 8B

none
लागत
$0.001
समय
3.2s
टोकन
491 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0

त्वरित तुलना

तुलना जोड़ी बदलें