नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.8 Max (low) vs Grok 4.6 (medium)

Qwen3.8 Max (low) average score मध्ये पुढे आहे: 8.6 vs 8.4. Qwen3.8 Max (low) चा benchmark खर्च कमी आहे: $0.702 vs $1.713. Qwen3.8 Max (low) वेगवान आहे: 21.83s vs 73.46s, pass rates 80.3% vs 81.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#35
एकूण आउटपुट टोकन्स
83,821
प्रतिसाद वेळ (सरासरी)
21.83s
एकूण खर्च
$0.702
क्रमांक
#39
एकूण आउटपुट टोकन्स
249,808
प्रतिसाद वेळ (सरासरी)
73.46s
एकूण खर्च
$1.713
शिफारस केलेले मॉडेल Qwen3.8 Max (low)

It has the best score here (8.6), while costing about 2.4x less than Grok 4.6 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.8 Max Qwen3.8 Max low प्रकाशन: 2026-08-04 Grok 4.6 Grok 4.6 medium प्रकाशन: 2026-08-12
स्कोअर 8.6 8.4
क्रमांक #35 #39
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 80.3% 81.8%
अस्थिर चाचण्या 3 4
एकूण रन 66 66
प्रति निकाल खर्च 4.384 10.703
एकूण खर्च $0.702 $1.713
इनपुट किंमत $2.000 / 1M $2.000 / 1M
आउटपुट किंमत $6.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 99,181 106,787
आउटपुट टोकन्स 6,132 4,811
रिझनिंग टोकन्स 77,689 244,997
प्रतिसाद वेळ (सरासरी) 21.83s 73.46s
प्रतिसाद वेळ (कमाल) 155.75s 514.35s
प्रतिसाद वेळ (एकूण) 480.37s 1616.12s
पॅरामीटर्स 2.4T एकूण (~100B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Qwen3.8 Max

low
खर्च
$0.026
वेळ
68.5s
टोकन्स
4,280 tok

#39 SpaceXAI: Grok 4.6

medium
खर्च
$0.028
वेळ
72.1s
टोकन्स
4,771 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

झटपट तुलना

तुलना जोडी बदला