नेविगेशन
Advertise here

Trinity Large Thinking (low) vs Gemma 4 31B

average score लगभग बराबर है: 6.0 vs 6.1. Gemma 4 31B की benchmark लागत कम है: $0.016 vs $0.625. Gemma 4 31B तेज है: 5.41s vs 96.61s, pass rates 47.0% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#237
कुल आउटपुट टोकन
818,359
प्रतिक्रिया समय (औसत)
96.61s
कुल लागत
$0.625
रैंक
#234
कुल आउटपुट टोकन
13,317
प्रतिक्रिया समय (औसत)
5.41s
कुल लागत
$0.016
अनुशंसित मॉडल Gemma 4 31B

It has the best score here (6.1), while costing about 39.4x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 6.0 6.1
रैंक #237 #234
विश्वसनीयता 10.0 10.0
संगति 8.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 47.0% 43.9%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 8.221 0.366
कुल लागत $0.625 $0.016
इनपुट कीमत $0.250 / 1M $0.090 / 1M
आउटपुट कीमत $0.800 / 1M $0.340 / 1M
कुल इनपुट टोकन 122,854 125,703
आउटपुट टोकन 119,810 13,317
रीजनिंग टोकन 698,549 0
प्रतिक्रिया समय (औसत) 96.61s 5.41s
प्रतिक्रिया समय (अधिकतम) 540.96s 29.95s
प्रतिक्रिया समय (कुल) 2125.51s 108.12s
पैरामीटर 398B कुल (13B सक्रिय) 30.7B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#237 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#234 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0

त्वरित तुलना

तुलना जोड़ी बदलें