नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.20 (medium)

average score लगभग बराबर है: 7.2 vs 7.1. Qwen3.7 Plus की benchmark लागत कम है: $0.106 vs $0.777. Qwen3.7 Plus तेज है: 12.09s vs 29.47s, pass rates 50.0% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#81
कुल आउटपुट टोकन
58,097
प्रतिक्रिया समय (औसत)
12.09s
कुल लागत
$0.106
रैंक
#85
कुल आउटपुट टोकन
259,340
प्रतिक्रिया समय (औसत)
29.47s
कुल लागत
$0.777
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.2), while costing about 7.3x less than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.2 7.1
रैंक #81 #85
विश्वसनीयता 10.0 10.0
संगति 10.0 8.5
सही परीक्षण
प्रति प्रयास पास दर 50.0% 63.6%
अस्थिर टेस्ट 0 4
कुल रन 66 66
प्रति परिणाम लागत 1.014 9.709
कुल लागत $0.106 $0.777
इनपुट कीमत $0.320 / 1M $1.250 / 1M
आउटपुट कीमत $1.280 / 1M $2.500 / 1M
कुल इनपुट टोकन 98,824 102,791
आउटपुट टोकन 58,097 5,363
रीजनिंग टोकन 0 253,977
प्रतिक्रिया समय (औसत) 12.09s 29.47s
प्रतिक्रिया समय (अधिकतम) 206.03s 199.66s
प्रतिक्रिया समय (कुल) 265.89s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#85 xAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें