नेविगेशन
Advertise here

Qwen3.7 Plus (medium) vs Grok 4.5 (high)

average score लगभग बराबर है: 8.3 vs 8.2. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.432 vs $2.571. Qwen3.7 Plus (medium) तेज है: 59.73s vs 72.50s, pass rates 76.8% vs 82.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#81
कुल आउटपुट टोकन
215,560
प्रतिक्रिया समय (औसत)
59.73s
कुल लागत
$0.432
रैंक
#82
कुल आउटपुट टोकन
333,632
प्रतिक्रिया समय (औसत)
72.50s
कुल लागत
$2.571
अनुशंसित मॉडल Qwen3.7 Plus (medium)

It has the best score here (8.3), while costing about 6.0x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 8.3 8.2
रैंक #81 #82
विश्वसनीयता 10.0 10.0
संगति 8.9 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 82.6%
अस्थिर टेस्ट 3 3
कुल रन 69 69
प्रति परिणाम लागत 2.697 15.123
कुल लागत $0.432 $2.571
इनपुट कीमत $0.320 / 1M $2.000 / 1M
आउटपुट कीमत $1.280 / 1M $6.000 / 1M
कुल इनपुट टोकन 350,546 342,124
आउटपुट टोकन 8,576 7,135
रीजनिंग टोकन 206,984 326,497
प्रतिक्रिया समय (औसत) 59.73s 72.50s
प्रतिक्रिया समय (अधिकतम) 315.30s 676.83s
प्रतिक्रिया समय (कुल) 1373.73s 1667.51s
पैरामीटर ~397B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

#82 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें