नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.20 (medium)

average score जवळपास समान आहे: 7.2 vs 7.1. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $0.777. Qwen3.7 Plus वेगवान आहे: 12.09s vs 29.47s, pass rates 50.0% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#79
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.09s
एकूण खर्च
$0.106
क्रमांक
#83
एकूण आउटपुट टोकन्स
259,340
प्रतिसाद वेळ (सरासरी)
29.47s
एकूण खर्च
$0.777
शिफारस केलेले मॉडेल Qwen3.7 Plus

It has the best score here (7.2), while costing about 7.3x less than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.2 7.1
क्रमांक #79 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 63.6%
अस्थिर चाचण्या 0 4
एकूण रन 66 66
प्रति निकाल खर्च 1.014 9.709
एकूण खर्च $0.106 $0.777
इनपुट किंमत $0.320 / 1M $1.250 / 1M
आउटपुट किंमत $1.280 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 98,824 102,791
आउटपुट टोकन्स 58,097 5,363
रिझनिंग टोकन्स 0 253,977
प्रतिसाद वेळ (सरासरी) 12.09s 29.47s
प्रतिसाद वेळ (कमाल) 206.03s 199.66s
प्रतिसाद वेळ (एकूण) 265.89s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

#83 xAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला