नेविगेशन
AI BENCHY
Advertise here

Gemma 4 31B vs gpt-oss-120b (medium)

Gemma 4 31B average score में आगे है: 6.2 vs 6.1. gpt-oss-120b (medium) की benchmark लागत कम है: $0.019 vs $0.023. Gemma 4 31B तेज है: 5.34s vs 21.91s, pass rates 48.5% vs 50.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#126
कुल आउटपुट टोकन
13,317
प्रतिक्रिया समय (औसत)
5.34s
कुल लागत
$0.023
रैंक
#132
कुल आउटपुट टोकन
97,816
प्रतिक्रिया समय (औसत)
21.91s
कुल लागत
$0.019
अनुशंसित मॉडल Gemma 4 31B

It has the best score here (6.2), while responding about 4.1x faster than gpt-oss-120b (medium).

विस्तृत तुलना

मेट्रिक Gemma 4 31B Gemma 4 31B none रिलीज़: 2026-04-02 निःशुल्क उपलब्ध gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05
स्कोर 6.2 6.1
रैंक #126 #132
विश्वसनीयता 10.0 10.0
संगति 9.6 8.0
सही परीक्षण
प्रति प्रयास पास दर 48.5% 50.0%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 0.330 0.221
कुल लागत $0.023 $0.019
इनपुट कीमत $0.140 / 1M $0.037 / 1M
आउटपुट कीमत $0.400 / 1M $0.170 / 1M
कुल इनपुट टोकन 125,728 108,747
आउटपुट टोकन 13,317 29,772
रीजनिंग टोकन 0 68,044
प्रतिक्रिया समय (औसत) 5.34s 21.91s
प्रतिक्रिया समय (अधिकतम) 29.95s 68.16s
प्रतिक्रिया समय (कुल) 106.82s 328.70s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Gemma 4 31B

none
लागत
$0.001
समय
12.8s
टोकन
795 tok

#132 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

त्वरित तुलना

तुलना जोड़ी बदलें