नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.3 (medium)

average score जवळपास समान आहे: 7.2 vs 7.1. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $0.779. Qwen3.7 Plus वेगवान आहे: 12.09s vs 47.45s, pass rates 50.0% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#81
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.09s
एकूण खर्च
$0.106
क्रमांक
#83
एकूण आउटपुट टोकन्स
241,421
प्रतिसाद वेळ (सरासरी)
47.45s
एकूण खर्च
$0.779
शिफारस केलेले मॉडेल Qwen3.7 Plus

It has the best score here (7.2), while costing about 7.3x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.2 7.1
क्रमांक #81 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 68.2%
अस्थिर चाचण्या 0 4
एकूण रन 66 66
प्रति निकाल खर्च 1.014 5.990
एकूण खर्च $0.106 $0.779
इनपुट किंमत $0.320 / 1M $1.250 / 1M
आउटपुट किंमत $1.280 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 98,824 140,031
आउटपुट टोकन्स 58,097 13,739
रिझनिंग टोकन्स 0 227,682
प्रतिसाद वेळ (सरासरी) 12.09s 47.45s
प्रतिसाद वेळ (कमाल) 206.03s 216.69s
प्रतिसाद वेळ (एकूण) 265.89s 1043.83s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

#83 xAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला