नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Flash (high) vs Qwen3.8 27B (medium)

average score जवळपास समान आहे: 7.8 vs 7.8. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Qwen3.8 27B (medium) वेगवान आहे: 33.05s vs 41.37s, pass rates 71.2% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#71
एकूण आउटपुट टोकन्स
370,250
प्रतिसाद वेळ (सरासरी)
41.37s
एकूण खर्च
$0.052
क्रमांक
#68
एकूण आउटपुट टोकन्स
136,162
प्रतिसाद वेळ (सरासरी)
33.05s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल Qwen3.7 Flash (high)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash high प्रकाशन: 2026-07-28 Qwen3.8 27B Qwen3.8 27B medium प्रकाशन: 2026-08-14
स्कोअर 7.8 7.8
क्रमांक #71 #68
विश्वसनीयता 10.0 9.6
सुसंगतता 7.8 9.7
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 66.7%
अस्थिर चाचण्या 6 1
एकूण रन 66 66
प्रति निकाल खर्च 0.398 लागू नाही
एकूण खर्च $0.052 लागू नाही
इनपुट किंमत $0.030 / 1M लागू नाही
आउटपुट किंमत $0.130 / 1M लागू नाही
एकूण इनपुट टोकन्स 116,331 98,266
आउटपुट टोकन्स 12,330 1,861
रिझनिंग टोकन्स 357,920 134,301
प्रतिसाद वेळ (सरासरी) 41.37s 33.05s
प्रतिसाद वेळ (कमाल) 431.47s 214.63s
प्रतिसाद वेळ (एकूण) 910.11s 694.04s
पॅरामीटर्स ~35B एकूण (~3B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Qwen3.7 Flash

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#68 Qwen3.8 27B

medium
खर्च
लागू नाही
वेळ
43.4s
टोकन्स
2,956 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Flash 8.2 9.7 66.7% 0 58.84s 7,893 503 62,350
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

झटपट तुलना

तुलना जोडी बदला

Claude Opus 4.8lowvsQwen3.7 FlashhighSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumQwen3.7 FlashhighvsGLM 5mediumSeed-2.0-CodelowvsQwen3.7 FlashhighClaude Opus 4.6mediumvsQwen3.7 FlashhighSeed-2.0-CodelowvsQwen3.8 27BmediumClaude Sonnet 4.6mediumvsQwen3.7 FlashhighGPT-5.6 TerramediumvsQwen3.7 FlashhighQwen3.7 FlashhighvsGLM 5.2mediumGemini 3.5 Flash LitemediumvsQwen3.7 FlashhighDeepSeek V4 ProhighvsQwen3.8 27Bmedium