नेविगेशन
Advertise here

Qwen3.7 Plus (medium) vs Grok 4.7 (low)

Grok 4.7 (low) average score में आगे है: 7.9 vs 7.9. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.277 vs $1.320. Qwen3.7 Plus (medium) तेज है: 53.51s vs 59.02s, pass rates 75.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#86
कुल आउटपुट टोकन
187,337
प्रतिक्रिया समय (औसत)
53.51s
कुल लागत
$0.277
रैंक
#81
कुल आउटपुट टोकन
231,848
प्रतिक्रिया समय (औसत)
59.02s
कुल लागत
$1.320
अनुशंसित मॉडल Qwen3.7 Plus (medium)

Its score stays close to the best score here (7.9 vs 7.9), while costing about 4.8x less than Grok 4.7 (low).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03 Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21
स्कोर 7.9 7.9
रैंक #86 #81
विश्वसनीयता 10.0 10.0
संगति 8.9 8.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 77.3%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 2.134 9.422
कुल लागत $0.277 $1.320
इनपुट कीमत $0.320 / 1M $1.600 / 1M
आउटपुट कीमत $1.280 / 1M $4.800 / 1M
कुल इनपुट टोकन 115,242 128,832
आउटपुट टोकन 6,163 6,840
रीजनिंग टोकन 181,174 225,008
प्रतिक्रिया समय (औसत) 53.51s 59.02s
प्रतिक्रिया समय (अधिकतम) 315.30s 389.63s
प्रतिक्रिया समय (कुल) 1177.25s 1298.42s
पैरामीटर ~397B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

#81 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

त्वरित तुलना

तुलना जोड़ी बदलें