नेव्हिगेशन
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (low) vs Qwen3.5-27B

average score जवळपास समान आहे: 6.5 vs 6.5. Qwen3.5-27B चा benchmark खर्च कमी आहे: $0.058 vs $0.621. Qwen3.5-27B वेगवान आहे: 4.76s vs 16.26s, pass rates 59.1% vs 40.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#118
एकूण आउटपुट टोकन्स
397,885
प्रतिसाद वेळ (सरासरी)
16.26s
एकूण खर्च
$0.621
क्रमांक
#116
एकूण आउटपुट टोकन्स
24,321
प्रतिसाद वेळ (सरासरी)
4.76s
एकूण खर्च
$0.058
शिफारस केलेले मॉडेल Qwen3.5-27B

It has the best score here (6.5), while costing about 10.7x less than Gemini 3.1 Flash Lite (low).

तपशीलवार तुलना

मेट्रिक Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low प्रकाशन: 2026-05-08 Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 6.5 6.5
क्रमांक #118 #116
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.1% 40.9%
अस्थिर चाचण्या 2 2
एकूण रन 66 66
प्रति निकाल खर्च 5.170 0.763
एकूण खर्च $0.621 $0.058
इनपुट किंमत $0.250 / 1M $0.195 / 1M
आउटपुट किंमत $1.500 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 94,224 102,316
आउटपुट टोकन्स 7,759 24,321
रिझनिंग टोकन्स 390,126 0
प्रतिसाद वेळ (सरासरी) 16.26s 4.76s
प्रतिसाद वेळ (कमाल) 318.02s 69.46s
प्रतिसाद वेळ (एकूण) 357.64s 104.71s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Gemini 3.1 Flash Lite

low
खर्च
$0.003
वेळ
4.0s
टोकन्स
1,479 tok

#116 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला