नेव्हिगेशन
Advertise here

Qwen3.7 Max vs Grok 4.7 (high)

average score जवळपास समान आहे: 7.4 vs 7.5. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $2.180. Qwen3.7 Max वेगवान आहे: 4.56s vs 113.10s, pass rates 68.2% vs 75.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-21

तुलना केलेली मॉडेल्स

क्रमांक
#120
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
क्रमांक
#110
एकूण आउटपुट टोकन्स
416,086
प्रतिसाद वेळ (सरासरी)
113.10s
एकूण खर्च
$2.180
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while costing about 11.1x less than Grok 4.7 (high).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22 Grok 4.7 Grok 4.7 high प्रकाशन: 2026-09-21
स्कोअर 7.4 7.5
क्रमांक #120 #110
विश्वसनीयता 9.9 9.5
सुसंगतता 10.0 7.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 75.8%
अस्थिर चाचण्या 0 7
एकूण रन 66 66
प्रति निकाल खर्च 1.581 16.765
एकूण खर्च $0.197 $2.180
इनपुट किंमत $1.475 / 1M $1.600 / 1M
आउटपुट किंमत $4.425 / 1M $4.800 / 1M
एकूण इनपुट टोकन्स 95,992 113,892
आउटपुट टोकन्स 12,446 6,907
रिझनिंग टोकन्स 0 409,179
प्रतिसाद वेळ (सरासरी) 4.56s 113.10s
प्रतिसाद वेळ (कमाल) 72.30s 573.57s
प्रतिसाद वेळ (एकूण) 100.30s 2488.20s
पॅरामीटर्स ~1T एकूण (~40B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

#110 SpaceXAI: Grok 4.7

high
खर्च
$0.110
वेळ
301.3s
टोकन्स
23,143 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

झटपट तुलना

तुलना जोडी बदला