नेव्हिगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (low) vs Qwen3.7 Max

average score जवळपास समान आहे: 7.5 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.239. Qwen3.7 Max वेगवान आहे: 4.56s vs 4.83s, pass rates 81.8% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-02

क्रमांक
#99
एकूण आउटपुट टोकन्स
41,324
प्रतिसाद वेळ (सरासरी)
4.83s
एकूण खर्च
$0.239
क्रमांक
#101
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the strongest score in this comparison (7.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash low प्रकाशन: 2026-09-02 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 7.5 7.4
क्रमांक #99 #101
विश्वसनीयता 10.0 9.9
सुसंगतता 8.5 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.8% 68.2%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 1.493 1.581
एकूण खर्च $0.239 $0.197
इनपुट किंमत $0.750 / 1M $1.475 / 1M
आउटपुट किंमत $3.750 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 111,773 95,992
आउटपुट टोकन्स 8,035 12,446
रिझनिंग टोकन्स 33,289 0
प्रतिसाद वेळ (सरासरी) 4.83s 4.56s
प्रतिसाद वेळ (कमाल) 35.14s 72.30s
प्रतिसाद वेळ (एकूण) 106.18s 100.30s
पॅरामीटर्स ~500B एकूण (~20B सक्रिय) ~1T एकूण (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#99 Gemini 3.8 Flash

low
खर्च
$0.030
वेळ
45.8s
टोकन्स
8,023 tok

#101 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Gemini 3.8 Flash 5.4 7.2 44.4% 1 4.31s 8,118 449 5,706
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला