नेविगेशन
Advertise here

Qwen3.5-27B (medium) vs Grok 4.7 (high)

average score लगभग बराबर है: 7.5 vs 7.5. Qwen3.5-27B (medium) की benchmark लागत कम है: $0.982 vs $2.180. Grok 4.7 (high) तेज है: 113.10s vs 113.28s, pass rates 75.8% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#114
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
रैंक
#110
कुल आउटपुट टोकन
416,086
प्रतिक्रिया समय (औसत)
113.10s
कुल लागत
$2.180
अनुशंसित मॉडल Qwen3.5-27B (medium)

It has the best score here (7.5), while costing about 2.2x less than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 7.5 7.5
रैंक #114 #110
विश्वसनीयता 10.0 9.5
संगति 7.8 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 75.8%
अस्थिर टेस्ट 6 7
कुल रन 66 66
प्रति परिणाम लागत 8.217 16.765
कुल लागत $0.982 $2.180
इनपुट कीमत $0.195 / 1M $1.600 / 1M
आउटपुट कीमत $1.560 / 1M $4.800 / 1M
कुल इनपुट टोकन 111,644 113,892
आउटपुट टोकन 16,113 6,907
रीजनिंग टोकन 598,796 409,179
प्रतिक्रिया समय (औसत) 113.28s 113.10s
प्रतिक्रिया समय (अधिकतम) 1026.43s 573.57s
प्रतिक्रिया समय (कुल) 2492.26s 2488.20s
पैरामीटर 27B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#110 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें