नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Gemma 4 31B

average score लगभग बराबर है: 6.1 vs 6.1. Gemma 4 31B की benchmark लागत कम है: $0.018 vs $0.798. Gemma 4 31B तेज है: 5.41s vs 85.44s, pass rates 48.5% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#169
कुल आउटपुट टोकन
1,016,785
प्रतिक्रिया समय (औसत)
85.44s
कुल लागत
$0.798
रैंक
#171
कुल आउटपुट टोकन
13,317
प्रतिक्रिया समय (औसत)
5.41s
कुल लागत
$0.018
अनुशंसित मॉडल Gemma 4 31B

It has the best score here (6.1), while costing about 46.7x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 6.1 6.1
रैंक #169 #171
विश्वसनीयता 10.0 10.0
संगति 7.9 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 48.5% 43.9%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 9.972 0.366
कुल लागत $0.798 $0.018
इनपुट कीमत $0.220 / 1M $0.100 / 1M
आउटपुट कीमत $0.850 / 1M $0.340 / 1M
कुल इनपुट टोकन 118,486 125,703
आउटपुट टोकन 156,166 13,317
रीजनिंग टोकन 860,619 0
प्रतिक्रिया समय (औसत) 85.44s 5.41s
प्रतिक्रिया समय (अधिकतम) 525.14s 29.95s
प्रतिक्रिया समय (कुल) 1879.75s 108.12s
पैरामीटर 398B कुल (13B सक्रिय) 30.7B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#171 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0

त्वरित तुलना

तुलना जोड़ी बदलें