नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs OpenAI: gpt-oss-120b

सारांश

Gemma 4 31B vs gpt-oss-120b benchmark तुलना: gpt-oss-120b average score मध्ये पुढे आहे: 6.7 vs 6.3. gpt-oss-120b चा benchmark खर्च कमी आहे: $0.013 vs $0.033. gpt-oss-120b वेगवान आहे: 22.28s vs 56.55s, pass rates 69.8% vs 52.4%.

शिफारस केलेले मॉडेल: gpt-oss-120b - It has the best score here (6.7), while costing about 2.7x less than Gemma 4 31B.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Gemma 4 31B Gemma 4 31B medium प्रकाशन: 2026-04-02 मोफत उपलब्ध gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 मोफत उपलब्ध
स्कोअर 6.3 6.7
क्रमांक #88 #78
विश्वसनीयता 10.0 10.0
सुसंगतता 9.4 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.8% 52.4%
अस्थिर चाचण्या 1 5
एकूण रन 63 63
प्रति निकाल खर्च 0.257 0.141
एकूण खर्च $0.033 $0.013
इनपुट किंमत $0.120 / 1M $0.039 / 1M
आउटपुट किंमत $0.350 / 1M $0.180 / 1M
एकूण इनपुट टोकन्स 17,957 39,084
आउटपुट टोकन्स 22,356 20,013
रिझनिंग टोकन्स 65,726 50,233
प्रतिसाद वेळ (सरासरी) 56.55s 22.28s
प्रतिसाद वेळ (कमाल) 437.40s 68.16s
प्रतिसाद वेळ (एकूण) 1074.41s 311.96s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 Gemma 4 31B

medium
खर्च
$0.002
वेळ
45.7s
टोकन्स
2,696 tok

#78 gpt-oss-120b

medium
खर्च
$0.001
वेळ
26.7s
टोकन्स
555 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

झटपट तुलना

तुलना जोडी बदला