नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Preview (default) vs Granite 4.2 8B

average score लगभग बराबर है: 4.4 vs 4.4. Trinity Large Preview (default) की benchmark लागत कम है: $0.008 vs $0.037. Trinity Large Preview (default) तेज है: 2.83s vs 84.66s, pass rates 20.3% vs 15.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#349
कुल आउटपुट टोकन
2,169
प्रतिक्रिया समय (औसत)
2.83s
कुल लागत
$0.008
रैंक
#350
कुल आउटपुट टोकन
133,268
प्रतिक्रिया समय (औसत)
84.66s
कुल लागत
$0.037
अनुशंसित मॉडल Trinity Large Preview (default)

It has the best score here (4.4), while costing about 4.7x less than Granite 4.2 8B.

विस्तृत तुलना

मेट्रिक Trinity Large Preview Trinity Large Preview default रिलीज़: 2026-01-27 निःशुल्क उपलब्ध Granite 4.2 8B Granite 4.2 8B none रिलीज़: 2026-09-02
स्कोर 4.4 4.4
रैंक #349 #350
विश्वसनीयता 10.0 9.1
संगति 9.0 9.3
प्रयास 66/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 20.3% 15.9%
अस्थिर टेस्ट 2 2
कुल रन 66 69
प्रति परिणाम लागत 0.017 1.206
कुल लागत $0.008 $0.037
इनपुट कीमत $0.243 / 1M $0.060 / 1M
आउटपुट कीमत $0.243 / 1M $0.250 / 1M
कैश पढ़ने की कीमत लागू नहीं $0.015 / 1M
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 29,828 226,872
आउटपुट टोकन 2,169 133,268
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 2.83s 84.66s
प्रतिक्रिया समय (अधिकतम) 14.34s 747.17s
प्रतिक्रिया समय (कुल) 56.65s 1947.17s
पैरामीटर 398B कुल (13B सक्रिय) 8B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#349 Trinity Large Preview

default
No endpoints found for arcee-ai/trinity-large-preview:free.
लागत
$0.000
समय
0.0s
टोकन
0 tok

#350 IBM: Granite 4.2 8B

none
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0

त्वरित तुलना

तुलना जोड़ी बदलें

Granite 4.2 8BnonevsKAT Coder AIR V2.5defaultTrinity Large Previewdefaultनिःशुल्क उपलब्धvsNemotron 3 Supernoneनिःशुल्क उपलब्धCobuddymediumनिःशुल्क उपलब्धvsGranite 4.2 8BnoneTrinity Large Previewdefaultनिःशुल्क उपलब्धvsCobuddymediumनिःशुल्क उपलब्धTrinity Large Previewdefaultनिःशुल्क उपलब्धvsMercury 2noneGranite 4.2 8BnonevsRing 2.6 1tdefaultGranite 4.2 8BnonevsLing 2.6 FlashdefaultGranite 4.2 8BnonevsMiniMax M2.5mediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsMiniMax M2.5mediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsNemotron 3.5 Lightninglowनिःशुल्क उपलब्धTrinity Large Previewdefaultनिःशुल्क उपलब्धvsLaguna S 2.1lowनिःशुल्क उपलब्धGranite 4.2 8BnonevsNemotron 3.5 Lightninglowनिःशुल्क उपलब्ध