नेविगेशन
Advertise here

Gemini 3.1 Flash Lite (low) vs Qwen3.5-27B

average score लगभग बराबर है: 6.6 vs 6.6. Qwen3.5-27B की benchmark लागत कम है: $0.058 vs $0.621. Qwen3.5-27B तेज है: 4.77s vs 16.25s, pass rates 63.6% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#175
कुल आउटपुट टोकन
397,891
प्रतिक्रिया समय (औसत)
16.25s
कुल लागत
$0.621
रैंक
#172
कुल आउटपुट टोकन
24,323
प्रतिक्रिया समय (औसत)
4.77s
कुल लागत
$0.058
अनुशंसित मॉडल Qwen3.5-27B

It has the best score here (6.6), while costing about 10.7x less than Gemini 3.1 Flash Lite (low).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low रिलीज़: 2026-05-08 Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24
स्कोर 6.6 6.6
रैंक #175 #172
विश्वसनीयता 10.0 10.0
संगति 9.2 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 45.5%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 4.773 0.678
कुल लागत $0.621 $0.058
इनपुट कीमत $0.250 / 1M $0.195 / 1M
आउटपुट कीमत $1.500 / 1M $1.560 / 1M
कुल इनपुट टोकन 94,233 102,325
आउटपुट टोकन 7,759 24,323
रीजनिंग टोकन 390,132 0
प्रतिक्रिया समय (औसत) 16.25s 4.77s
प्रतिक्रिया समय (अधिकतम) 318.02s 69.46s
प्रतिक्रिया समय (कुल) 357.39s 105.00s
पैरामीटर ~150B कुल (~10B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#175 Gemini 3.1 Flash Lite

low
लागत
$0.003
समय
4.0s
टोकन
1,479 tok

#172 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

त्वरित तुलना

तुलना जोड़ी बदलें