नेव्हिगेशन
Advertise here

Qwen3.7 Max vs Grok 4.6 (low)

Qwen3.7 Max average score मध्ये पुढे आहे: 7.4 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.449. Qwen3.7 Max वेगवान आहे: 4.56s vs 14.55s, pass rates 68.2% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-24

तुलना केलेली मॉडेल्स

क्रमांक
#129
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.56s
एकूण खर्च
$0.197
क्रमांक
#135
एकूण आउटपुट टोकन्स
38,048
प्रतिसाद वेळ (सरासरी)
14.55s
एकूण खर्च
$0.449
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while costing about 2.3x less than Grok 4.6 (low).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22 Grok 4.6 Grok 4.6 low प्रकाशन: 2026-08-12
स्कोअर 7.4 7.4
क्रमांक #129 #135
विश्वसनीयता 9.9 10.0
सुसंगतता 10.0 9.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 69.7%
अस्थिर चाचण्या 0 1
एकूण रन 66 66
प्रति निकाल खर्च 1.581 2.989
एकूण खर्च $0.197 $0.449
इनपुट किंमत $1.475 / 1M $2.000 / 1M
आउटपुट किंमत $4.425 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 95,992 109,960
आउटपुट टोकन्स 12,446 5,124
रिझनिंग टोकन्स 0 32,924
प्रतिसाद वेळ (सरासरी) 4.56s 14.55s
प्रतिसाद वेळ (कमाल) 72.30s 26.46s
प्रतिसाद वेळ (एकूण) 100.30s 320.17s
पॅरामीटर्स ~1T एकूण (~40B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#129 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

#135 SpaceXAI: Grok 4.6

low
खर्च
$0.011
वेळ
26.0s
टोकन्स
1,941 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

झटपट तुलना

तुलना जोडी बदला