नेविगेशन
Advertise here

Qwen3.5-27B (medium) vs Grok 4.7 (xhigh)

Grok 4.7 (xhigh) average score में आगे है: 7.5 vs 7.5. Qwen3.5-27B (medium) की benchmark लागत कम है: $0.982 vs $2.625. Qwen3.5-27B (medium) तेज है: 113.28s vs 115.74s, pass rates 75.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#114
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
रैंक
#107
कुल आउटपुट टोकन
505,069
प्रतिक्रिया समय (औसत)
115.74s
कुल लागत
$2.625
अनुशंसित मॉडल Qwen3.5-27B (medium)

Its score stays close to the best score here (7.5 vs 7.5), while costing about 2.7x less than Grok 4.7 (xhigh).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 Grok 4.7 Grok 4.7 xhigh रिलीज़: 2026-09-21
स्कोर 7.5 7.5
रैंक #114 #107
विश्वसनीयता 10.0 9.6
संगति 7.8 7.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 77.3%
अस्थिर टेस्ट 6 6
कुल रन 66 66
प्रति परिणाम लागत 8.217 18.745
कुल लागत $0.982 $2.625
इनपुट कीमत $0.195 / 1M $1.600 / 1M
आउटपुट कीमत $1.560 / 1M $4.800 / 1M
कुल इनपुट टोकन 111,644 124,896
आउटपुट टोकन 16,113 4,890
रीजनिंग टोकन 598,796 500,179
प्रतिक्रिया समय (औसत) 113.28s 115.74s
प्रतिक्रिया समय (अधिकतम) 1026.43s 775.64s
प्रतिक्रिया समय (कुल) 2492.26s 2546.31s
पैरामीटर 27B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#107 SpaceXAI: Grok 4.7

xhigh
लागत
$0.235
समय
544.2s
टोकन
39,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

त्वरित तुलना

तुलना जोड़ी बदलें