नेविगेशन
Advertise here

Qwen3.7 Flash (high) vs Qwen3.8 27B (medium)

average score लगभग बराबर है: 7.8 vs 7.8. Qwen3.7 Flash (high) की benchmark लागत कम है: $0.052 vs ~$0.058. Qwen3.8 27B (medium) तेज है: 33.05s vs 41.37s, pass rates 71.2% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#104
कुल आउटपुट टोकन
370,250
प्रतिक्रिया समय (औसत)
41.37s
कुल लागत
$0.052
रैंक
#101
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
~$0.058
अनुशंसित मॉडल Qwen3.8 27B (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash high रिलीज़: 2026-07-28 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.8 7.8
रैंक #104 #101
विश्वसनीयता 10.0 9.6
संगति 7.8 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 66.7%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 0.398 ~0.409
कुल लागत $0.052 ~$0.058
इनपुट कीमत $0.030 / 1M लागू नहीं
आउटपुट कीमत $0.130 / 1M लागू नहीं
कुल इनपुट टोकन 116,331 98,266
आउटपुट टोकन 12,330 1,861
रीजनिंग टोकन 357,920 134,301
प्रतिक्रिया समय (औसत) 41.37s 33.05s
प्रतिक्रिया समय (अधिकतम) 431.47s 214.63s
प्रतिक्रिया समय (कुल) 910.11s 694.04s
पैरामीटर ~35B कुल (~3B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Qwen3.7 Flash

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

#101 Qwen3.8 27B

medium
लागत
~$0.002
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Flash 8.2 9.7 66.7% 0 58.84s 7,893 503 62,350
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsQwen3.7 FlashhighSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumQwen3.7 FlashhighvsGLM 5mediumSeed-2.0-CodelowvsQwen3.7 FlashhighClaude Opus 4.6mediumvsQwen3.7 FlashhighSeed-2.0-CodelowvsQwen3.8 27BmediumClaude Sonnet 4.6mediumvsQwen3.7 FlashhighGPT-5.6 TerramediumvsQwen3.7 FlashhighQwen3.7 FlashhighvsGLM 5.2mediumGemini 3.5 Flash LitemediumvsQwen3.7 FlashhighDeepSeek V4 ProhighvsQwen3.8 27Bmedium