नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: gpt-oss-120b

सारांश

Gemini 3.5 Flash vs gpt-oss-120b benchmark तुलना: Gemini 3.5 Flash average score मध्ये पुढे आहे: 7.0 vs 6.7. gpt-oss-120b चा benchmark खर्च कमी आहे: $0.013 vs $1.079. Gemini 3.5 Flash वेगवान आहे: 9.93s vs 22.28s, pass rates 77.8% vs 52.4%.

शिफारस केलेले मॉडेल: Gemini 3.5 Flash - It has the best score here (7.0), while responding about 2.2x faster than gpt-oss-120b.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-12

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash none प्रकाशन: 2026-05-19 gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 मोफत उपलब्ध
स्कोअर 7.0 6.7
क्रमांक #66 #78
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 77.8% 52.4%
अस्थिर चाचण्या 3 5
एकूण रन 63 63
प्रति निकाल खर्च 7.190 0.141
एकूण खर्च $1.079 $0.013
इनपुट किंमत $1.500 / 1M $0.039 / 1M
आउटपुट किंमत $9.000 / 1M $0.180 / 1M
एकूण इनपुट टोकन्स 13,843 39,084
आउटपुट टोकन्स 117,518 20,013
रिझनिंग टोकन्स 0 50,233
प्रतिसाद वेळ (सरासरी) 9.93s 22.28s
प्रतिसाद वेळ (कमाल) 64.36s 68.16s
प्रतिसाद वेळ (एकूण) 178.68s 311.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Gemini 3.5 Flash

none
Cost
$0.225
Time
125.5s
Tokens
25,004 tok

#78 gpt-oss-120b

medium
Cost
$0.001
Time
26.7s
Tokens
555 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

झटपट तुलना

तुलना जोडी बदला