नेविगेशन
Advertise here

Trinity Large Preview (default) vs gpt-oss-120b

Trinity Large Preview (default) average score में आगे है: 4.4 vs 4.2. Trinity Large Preview (default) की benchmark लागत कम है: $0.008 vs $0.016. Trinity Large Preview (default) तेज है: 2.83s vs 28.63s, pass rates 20.3% vs 34.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#349
कुल आउटपुट टोकन
2,169
प्रतिक्रिया समय (औसत)
2.83s
कुल लागत
$0.008
रैंक
#356
कुल आउटपुट टोकन
62,213
प्रतिक्रिया समय (औसत)
28.63s
कुल लागत
$0.016
अनुशंसित मॉडल Trinity Large Preview (default)

It has the best score here (4.4), while costing about 2.0x less than gpt-oss-120b.

विस्तृत तुलना

मेट्रिक Trinity Large Preview Trinity Large Preview default रिलीज़: 2026-01-27 निःशुल्क उपलब्ध gpt-oss-120b gpt-oss-120b none रिलीज़: 2025-08-05
स्कोर 4.4 4.2
रैंक #349 #356
विश्वसनीयता 10.0 10.0
संगति 9.0 7.6
प्रयास 66/69 60/69
सही परीक्षण
प्रति प्रयास पास दर 20.3% 34.8%
अस्थिर टेस्ट 2 3
कुल रन 66 60
प्रति परिणाम लागत 0.017 0.274
कुल लागत $0.008 $0.016
इनपुट कीमत $0.243 / 1M $0.037 / 1M
आउटपुट कीमत $0.243 / 1M $0.170 / 1M
कैश पढ़ने की कीमत लागू नहीं लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 29,828 131,652
आउटपुट टोकन 2,169 16,869
रीजनिंग टोकन 0 53,081
प्रतिक्रिया समय (औसत) 2.83s 28.63s
प्रतिक्रिया समय (अधिकतम) 14.34s 140.90s
प्रतिक्रिया समय (कुल) 56.65s 486.69s
पैरामीटर 398B कुल (13B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#349 Trinity Large Preview

default
No endpoints found for arcee-ai/trinity-large-preview:free.
लागत
$0.000
समय
0.0s
टोकन
0 tok

#356 gpt-oss-120b

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

त्वरित तुलना

तुलना जोड़ी बदलें

Trinity Large Previewdefaultनिःशुल्क उपलब्धvsGranite 4.2 8BnoneTrinity Large Previewdefaultनिःशुल्क उपलब्धvsNemotron 3 Supernoneनिःशुल्क उपलब्धgpt-oss-120bnonevsGLM 4.7 FlashmediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsCobuddymediumनिःशुल्क उपलब्धTrinity Large Previewdefaultनिःशुल्क उपलब्धvsMercury 2noneMiniMax M2.5mediumvsgpt-oss-120bnonegpt-oss-120bnonevsQwen3.5-9BmediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsMiniMax M2.5mediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsNemotron 3.5 Lightninglowनिःशुल्क उपलब्धTrinity Large Previewdefaultनिःशुल्क उपलब्धvsLaguna S 2.1lowनिःशुल्क उपलब्धTrinity Large Previewdefaultनिःशुल्क उपलब्धvsGPT-5.4 NanononeTrinity Large Previewdefaultनिःशुल्क उपलब्धvsDeepSeek V3.2none