नेव्हिगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite Preview (low) vs Qwen3.5-27B

average score जवळपास समान आहे: 6.5 vs 6.5. Qwen3.5-27B चा benchmark खर्च कमी आहे: $0.058 vs $0.646. Qwen3.5-27B वेगवान आहे: 4.76s vs 16.70s, pass rates 59.1% vs 40.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#117
एकूण आउटपुट टोकन्स
412,200
प्रतिसाद वेळ (सरासरी)
16.70s
एकूण खर्च
$0.646
क्रमांक
#116
एकूण आउटपुट टोकन्स
24,321
प्रतिसाद वेळ (सरासरी)
4.76s
एकूण खर्च
$0.058
शिफारस केलेले मॉडेल Qwen3.5-27B

It has the best score here (6.5), while costing about 11.2x less than Gemini 3.1 Flash Lite Preview (low).

तपशीलवार तुलना

मेट्रिक Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low प्रकाशन: 2026-03-03 Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 6.5 6.5
क्रमांक #117 #116
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.1% 40.9%
अस्थिर चाचण्या 0 2
एकूण रन 66 66
प्रति निकाल खर्च 4.969 0.763
एकूण खर्च $0.646 $0.058
इनपुट किंमत $0.250 / 1M $0.195 / 1M
आउटपुट किंमत $1.500 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 110,185 102,316
आउटपुट टोकन्स 14,717 24,321
रिझनिंग टोकन्स 397,483 0
प्रतिसाद वेळ (सरासरी) 16.70s 4.76s
प्रतिसाद वेळ (कमाल) 309.35s 69.46s
प्रतिसाद वेळ (एकूण) 367.47s 104.71s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Gemini 3.1 Flash Lite Preview

low
खर्च
$0.002
वेळ
3.7s
टोकन्स
1,203 tok

#116 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 1.39s 8,138 660 1,060
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला