नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.7 Max vs xAI: Grok 4.5

Qwen3.7 Max (medium) average score मध्ये पुढे आहे: 9.2 vs 8.4. Grok 4.5 (low) चा benchmark खर्च कमी आहे: $0.935 vs $1.116. Grok 4.5 (low) वेगवान आहे: 15.56s vs 40.57s, pass rates 87.9% vs 75.8%.

शिफारस केलेले मॉडेलQwen3.7 Max (medium)It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium प्रकाशन: 2026-05-22 Grok 4.5 Grok 4.5 low प्रकाशन: 2026-07-08
स्कोअर 9.2 8.4
क्रमांक #11 #23
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 87.9% 75.8%
अस्थिर चाचण्या 2 1
एकूण रन 66 66
प्रति निकाल खर्च 8.292 5.844
एकूण खर्च $1.116 $0.935
इनपुट किंमत $1.475 / 1M $2.000 / 1M
आउटपुट किंमत $4.425 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 106,020 125,596
आउटपुट टोकन्स 5,748 7,505
रिझनिंग टोकन्स 211,004 106,446
प्रतिसाद वेळ (सरासरी) 40.57s 15.56s
प्रतिसाद वेळ (कमाल) 556.06s 205.28s
प्रतिसाद वेळ (एकूण) 892.57s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Qwen3.7 Max

medium
खर्च
$0.017
वेळ
68.8s
टोकन्स
4,526 tok

#23 xAI: Grok 4.5

low
खर्च
$0.011
वेळ
12.4s
टोकन्स
2,018 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

झटपट तुलना

तुलना जोडी बदला