नेविगेशन
Advertise here

Gemma 4 31B vs gpt-oss-120b (medium)

average score लगभग बराबर है: 6.1 vs 6.1. Gemma 4 31B की benchmark लागत कम है: $0.016 vs $0.020. Gemma 4 31B तेज है: 5.41s vs 20.81s, pass rates 43.9% vs 50.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#201
कुल आउटपुट टोकन
13,317
प्रतिक्रिया समय (औसत)
5.41s
कुल लागत
$0.016
रैंक
#194
कुल आउटपुट टोकन
98,282
प्रतिक्रिया समय (औसत)
20.81s
कुल लागत
$0.020
अनुशंसित मॉडल Gemma 4 31B

It has the best score here (6.1), while responding about 3.8x faster than gpt-oss-120b (medium).

विस्तृत तुलना

मेट्रिक Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05
स्कोर 6.1 6.1
रैंक #201 #194
विश्वसनीयता 10.0 10.0
संगति 9.6 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 43.9% 50.0%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 0.366 0.224
कुल लागत $0.016 $0.020
इनपुट कीमत $0.090 / 1M $0.037 / 1M
आउटपुट कीमत $0.340 / 1M $0.170 / 1M
कुल इनपुट टोकन 125,703 108,767
आउटपुट टोकन 13,317 29,378
रीजनिंग टोकन 0 68,904
प्रतिक्रिया समय (औसत) 5.41s 20.81s
प्रतिक्रिया समय (अधिकतम) 29.95s 68.16s
प्रतिक्रिया समय (कुल) 108.12s 332.88s
पैरामीटर 30.7B 117B कुल (5.1B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#201 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

#194 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

त्वरित तुलना

तुलना जोड़ी बदलें