नेविगेशन
Advertise here

Qwen3.5-27B vs Grok 4.7 (medium)

average score लगभग बराबर है: 7.2 vs 7.3. Qwen3.5-27B की benchmark लागत कम है: $0.116 vs $3.501. Qwen3.5-27B तेज है: 9.98s vs 117.65s, pass rates 47.8% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#139
कुल आउटपुट टोकन
36,422
प्रतिक्रिया समय (औसत)
9.98s
कुल लागत
$0.116
रैंक
#134
कुल आउटपुट टोकन
474,745
प्रतिक्रिया समय (औसत)
117.65s
कुल लागत
$3.501
अनुशंसित मॉडल Qwen3.5-27B

It has the best score here (7.2), while costing about 30.4x less than Grok 4.7 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24 Grok 4.7 Grok 4.7 medium रिलीज़: 2026-09-21
स्कोर 7.2 7.3
रैंक #139 #134
विश्वसनीयता 10.0 9.8
संगति 9.4 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 47.8% 78.3%
अस्थिर टेस्ट 2 5
कुल रन 69 69
प्रति परिणाम लागत 1.153 19.582
कुल लागत $0.116 $3.501
इनपुट कीमत $0.195 / 1M $2.000 / 1M
आउटपुट कीमत $1.560 / 1M $6.000 / 1M
कुल इनपुट टोकन 283,977 326,066
आउटपुट टोकन 36,422 5,726
रीजनिंग टोकन 0 469,019
प्रतिक्रिया समय (औसत) 9.98s 117.65s
प्रतिक्रिया समय (अधिकतम) 124.53s 660.89s
प्रतिक्रिया समय (कुल) 229.52s 2706.03s
पैरामीटर 27B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

#134 SpaceXAI: Grok 4.7

medium
लागत
$0.047
समय
132.3s
टोकन
9,954 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0
Grok 4.7 6.6 4.6 77.8% 2 312.17s 10,266 349 172,347

त्वरित तुलना

तुलना जोड़ी बदलें