नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.7 Plus vs xAI: Grok 4.5

Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.3 vs 7.9. Qwen3.7 Plus (medium) चा benchmark खर्च कमी आहे: $0.267 vs $1.928. Qwen3.7 Plus (medium) वेगवान आहे: 51.51s vs 61.71s, pass rates 75.8% vs 78.8%.

शिफारस केलेले मॉडेलQwen3.7 Plus (medium)Its score stays close to the best score here (7.9 vs 8.3), while costing about 7.2x less than Grok 4.5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus medium प्रकाशन: 2026-06-03 Grok 4.5 Grok 4.5 medium प्रकाशन: 2026-07-08
स्कोअर 7.9 8.3
क्रमांक #43 #28
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 75.8% 78.8%
अस्थिर चाचण्या 3 3
एकूण रन 66 66
प्रति निकाल खर्च 2.072 12.049
एकूण खर्च $0.267 $1.928
इनपुट किंमत $0.320 / 1M $2.000 / 1M
आउटपुट किंमत $1.280 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 115,233 122,146
आउटपुट टोकन्स 6,162 5,514
रिझनिंग टोकन्स 173,267 275,053
प्रतिसाद वेळ (सरासरी) 51.51s 61.71s
प्रतिसाद वेळ (कमाल) 315.30s 436.38s
प्रतिसाद वेळ (एकूण) 1133.15s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 Qwen3.7 Plus

medium
खर्च
$0.018
वेळ
193.2s
टोकन्स
10,821 tok

#28 xAI: Grok 4.5

medium
खर्च
$0.044
वेळ
59.4s
टोकन्स
7,512 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

झटपट तुलना

तुलना जोडी बदला