नेविगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite vs gpt-oss-120b (medium)

average score लगभग बराबर है: 6.1 vs 6.1. gpt-oss-120b (medium) की benchmark लागत कम है: $0.020 vs $0.046. Gemini 3.1 Flash Lite तेज है: 1.75s vs 20.81s, pass rates 50.0% vs 50.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-03

रैंक
#186
कुल आउटपुट टोकन
10,723
प्रतिक्रिया समय (औसत)
1.75s
कुल लागत
$0.046
रैंक
#184
कुल आउटपुट टोकन
98,282
प्रतिक्रिया समय (औसत)
20.81s
कुल लागत
$0.020
अनुशंसित मॉडल Gemini 3.1 Flash Lite

It has the best score here (6.1), while responding about 11.9x faster than gpt-oss-120b (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none रिलीज़: 2026-05-08 gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05
स्कोर 6.1 6.1
रैंक #186 #184
विश्वसनीयता 10.0 10.0
संगति 8.6 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 50.0% 50.0%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 0.507 0.224
कुल लागत $0.046 $0.020
इनपुट कीमत $0.250 / 1M $0.037 / 1M
आउटपुट कीमत $1.500 / 1M $0.170 / 1M
कुल इनपुट टोकन 118,059 108,767
आउटपुट टोकन 10,723 29,378
रीजनिंग टोकन 0 68,904
प्रतिक्रिया समय (औसत) 1.75s 20.81s
प्रतिक्रिया समय (अधिकतम) 16.25s 68.16s
प्रतिक्रिया समय (कुल) 38.42s 332.88s
पैरामीटर ~150B कुल (~10B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#186 Gemini 3.1 Flash Lite

none
लागत
$0.001
समय
4.5s
टोकन
727 tok

#184 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 938ms 8,128 666 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

त्वरित तुलना

तुलना जोड़ी बदलें