नेविगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (minimal) vs gpt-oss-120b (medium)

average score लगभग बराबर है: 6.1 vs 6.1. gpt-oss-120b (medium) की benchmark लागत कम है: $0.020 vs $0.047. Gemini 3.1 Flash Lite (minimal) तेज है: 1.85s vs 20.81s, pass rates 51.5% vs 50.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#182
कुल आउटपुट टोकन
11,118
प्रतिक्रिया समय (औसत)
1.85s
कुल लागत
$0.047
रैंक
#184
कुल आउटपुट टोकन
98,282
प्रतिक्रिया समय (औसत)
20.81s
कुल लागत
$0.020
अनुशंसित मॉडल Gemini 3.1 Flash Lite (minimal)

It has the best score here (6.1), while responding about 11.2x faster than gpt-oss-120b (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal रिलीज़: 2026-05-08 gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05
स्कोर 6.1 6.1
रैंक #182 #184
विश्वसनीयता 10.0 10.0
संगति 8.9 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 51.5% 50.0%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 0.465 0.224
कुल लागत $0.047 $0.020
इनपुट कीमत $0.250 / 1M $0.037 / 1M
आउटपुट कीमत $1.500 / 1M $0.170 / 1M
कुल इनपुट टोकन 119,076 108,767
आउटपुट टोकन 11,118 29,378
रीजनिंग टोकन 0 68,904
प्रतिक्रिया समय (औसत) 1.85s 20.81s
प्रतिक्रिया समय (अधिकतम) 12.97s 68.16s
प्रतिक्रिया समय (कुल) 40.74s 332.88s
पैरामीटर ~150B कुल (~10B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#182 Gemini 3.1 Flash Lite

minimal
लागत
$0.001
समय
3.7s
टोकन
635 tok

#184 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

त्वरित तुलना

तुलना जोड़ी बदलें