नेविगेशन
Advertise here

तुलना किए गए मॉडल

Qwen3.8 27B (low) vs Qwen3.8 Flash Next (low) vs Qwen3.8 27B (high) vs Qwen3.8 Flash Next (xhigh) benchmark तुलना: Qwen3.8 27B (high) स्कोर में 8.7 के साथ आगे है। Qwen3.8 27B (low) विश्वसनीयता में 10.0 के साथ आगे है। Qwen3.8 Flash Next (low) का कुल लागत सबसे कम है: ~$0.045. Qwen3.8 Flash Next (low) 23.66s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-05

तुलना किए गए मॉडल

रैंक
#121
कुल आउटपुट टोकन
209,143
प्रतिक्रिया समय (औसत)
46.60s
कुल लागत
~$0.089
रैंक
#96
कुल आउटपुट टोकन
135,295
प्रतिक्रिया समय (औसत)
23.66s
कुल लागत
~$0.045
रैंक
#55
कुल आउटपुट टोकन
677,080
प्रतिक्रिया समय (औसत)
166.34s
कुल लागत
~$0.298
रैंक
#154
कुल आउटपुट टोकन
621,056
प्रतिक्रिया समय (औसत)
102.66s
कुल लागत
~$0.195
अनुशंसित मॉडल Qwen3.8 Flash Next (low)

Its score stays close to the best score here (8.0 vs 8.7), while costing about 4.3x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B low रिलीज़: 2026-08-14 निःशुल्क उपलब्ध Qwen3.8 Flash Next Qwen3.8 Flash Next low रिलीज़: 2026-10-04 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14 निःशुल्क उपलब्ध Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh रिलीज़: 2026-10-04
स्कोर 7.6 8.0 8.7 7.1
रैंक #121 #96 #55 #154
विश्वसनीयता 10.0 10.0 9.7 9.9
संगति 9.7 8.0 9.2 7.9
प्रयास 69/69 69/69 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 68.1% 79.7% 78.3% 72.5%
अस्थिर टेस्ट 1 6 2 6
कुल रन 69 69 69 69
प्रति परिणाम लागत ~0.589 ~0.299 ~1.751 ~1.390
कुल लागत ~$0.089 ~$0.045 ~$0.298 ~$0.195
इनपुट कीमत लागू नहीं लागू नहीं लागू नहीं लागू नहीं
आउटपुट कीमत लागू नहीं लागू नहीं लागू नहीं लागू नहीं
कैश पढ़ने की कीमत लागू नहीं लागू नहीं लागू नहीं लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं लागू नहीं लागू नहीं
कुल इनपुट टोकन 315,290 342,163 348,967 301,749
आउटपुट टोकन 1,607 1,518 1,005 1,033
रीजनिंग टोकन 207,536 133,777 676,075 620,023
प्रतिक्रिया समय (औसत) 46.60s 23.66s 166.34s 102.66s
प्रतिक्रिया समय (अधिकतम) 376.04s 166.72s 640.85s 674.08s
प्रतिक्रिया समय (कुल) 1071.83s 544.16s 3825.81s 2361.10s
पैरामीटर 27.3B 180B कुल (6B सक्रिय) 27.3B 180B कुल (6B सक्रिय)
उपलब्धता वेट उपलब्ध वेट उपलब्ध वेट उपलब्ध वेट उपलब्ध

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#121 Qwen3.8 27B

low
लागत
~$0.003
समय
92.8s
टोकन
6,902 tok

#96 Qwen3.8 Flash Next

low
लागत
~$0.002
समय
47.2s
टोकन
5,270 tok

#55 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

#154 Qwen3.8 Flash Next

xhigh
लागत
~$0.010
समय
333.1s
टोकन
30,654 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धQwen3.8 27Bhighनिःशुल्क उपलब्धvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowGPT-6 SollowvsQwen3.8 27Bhighनिःशुल्क उपलब्धQwen3.8 27Blowनिःशुल्क उपलब्धvsSpace Bunny AlphahighQwen3.8 27Blowनिःशुल्क उपलब्धvsGLM 5.1mediumQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 Ultramediumनिःशुल्क उपलब्धvsQwen3.8 Flash Nextlow