नेव्हिगेशन
Advertise here

Qwen3.7 Max vs Grok 4.6 (medium)

Qwen3.7 Max average score मध्ये पुढे आहे: 7.9 vs 7.8. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.492 vs $2.270. Qwen3.7 Max वेगवान आहे: 7.85s vs 74.77s, pass rates 69.6% vs 78.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#100
एकूण आउटपुट टोकन्स
20,670
प्रतिसाद वेळ (सरासरी)
7.85s
एकूण खर्च
$0.492
क्रमांक
#107
एकूण आउटपुट टोकन्स
266,197
प्रतिसाद वेळ (सरासरी)
74.77s
एकूण खर्च
$2.270
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.9), while costing about 4.6x less than Grok 4.6 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22 Grok 4.6 Grok 4.6 medium प्रकाशन: 2026-08-12
स्कोअर 7.9 7.8
क्रमांक #100 #107
विश्वसनीयता 9.9 10.0
सुसंगतता 10.0 8.7
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.6% 78.3%
अस्थिर चाचण्या 0 4
एकूण रन 69 69
प्रति निकाल खर्च 3.070 14.187
एकूण खर्च $0.492 $2.270
इनपुट किंमत $1.475 / 1M $2.000 / 1M
आउटपुट किंमत $4.425 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 243,553 336,351
आउटपुट टोकन्स 20,670 6,180
रिझनिंग टोकन्स 0 260,017
प्रतिसाद वेळ (सरासरी) 7.85s 74.77s
प्रतिसाद वेळ (कमाल) 80.34s 514.35s
प्रतिसाद वेळ (एकूण) 180.65s 1719.73s
पॅरामीटर्स ~1T एकूण (~40B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#100 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

#107 SpaceXAI: Grok 4.6

medium
खर्च
$0.028
वेळ
72.1s
टोकन्स
4,771 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

झटपट तुलना

तुलना जोडी बदला