नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.3 (medium)

average score लगभग बराबर है: 7.2 vs 7.1. Qwen3.7 Plus की benchmark लागत कम है: $0.106 vs $0.779. Qwen3.7 Plus तेज है: 12.09s vs 47.45s, pass rates 50.0% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#81
कुल आउटपुट टोकन
58,097
प्रतिक्रिया समय (औसत)
12.09s
कुल लागत
$0.106
रैंक
#83
कुल आउटपुट टोकन
241,421
प्रतिक्रिया समय (औसत)
47.45s
कुल लागत
$0.779
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.2), while costing about 7.3x less than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.2 7.1
रैंक #81 #83
विश्वसनीयता 10.0 10.0
संगति 10.0 8.6
सही परीक्षण
प्रति प्रयास पास दर 50.0% 68.2%
अस्थिर टेस्ट 0 4
कुल रन 66 66
प्रति परिणाम लागत 1.014 5.990
कुल लागत $0.106 $0.779
इनपुट कीमत $0.320 / 1M $1.250 / 1M
आउटपुट कीमत $1.280 / 1M $2.500 / 1M
कुल इनपुट टोकन 98,824 140,031
आउटपुट टोकन 58,097 13,739
रीजनिंग टोकन 0 227,682
प्रतिक्रिया समय (औसत) 12.09s 47.45s
प्रतिक्रिया समय (अधिकतम) 206.03s 216.69s
प्रतिक्रिया समय (कुल) 265.89s 1043.83s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#83 xAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें