नेविगेशन
Advertise here

Qwen3.8 27B (high) vs Grok 4.5 (medium)

Grok 4.5 (medium) average score में आगे है: 8.5 vs 8.4. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.287 vs $2.042. Grok 4.5 (medium) तेज है: 68.59s vs 167.89s, pass rates 77.3% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#65
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
~$0.287
रैंक
#60
कुल आउटपुट टोकन
299,460
प्रतिक्रिया समय (औसत)
68.59s
कुल लागत
$2.042
अनुशंसित मॉडल Qwen3.8 27B (high)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 7.1x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.4 8.5
रैंक #65 #60
विश्वसनीयता 9.6 10.0
संगति 9.2 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 83.3%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत ~1.792 12.007
कुल लागत ~$0.287 $2.042
इनपुट कीमत लागू नहीं $2.000 / 1M
आउटपुट कीमत लागू नहीं $6.000 / 1M
कुल इनपुट टोकन 100,179 122,155
आउटपुट टोकन 904 5,514
रीजनिंग टोकन 655,731 293,946
प्रतिक्रिया समय (औसत) 167.89s 68.59s
प्रतिक्रिया समय (अधिकतम) 640.85s 436.38s
प्रतिक्रिया समय (कुल) 3693.54s 1508.91s
पैरामीटर 27.3B ~1.7T कुल (~170B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

#60 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighQwen3.8 27BhighvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BhighvsGrok 4.5lowGPT-6 SollowvsQwen3.8 27BhighQwen3.8 27BhighvsGLM 5.3 FlashXmaxQwen3.8 27BhighvsGrok 4.6mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighMuse Spark 1.2lowvsQwen3.8 27Bhigh