नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (high) vs Grok 4.6 (medium)

average score जवळपास समान आहे: 8.4 vs 8.4. Qwen3.8 27B (high) चा benchmark खर्च कमी आहे: ~$0.287 vs $1.713. Grok 4.6 (medium) वेगवान आहे: 73.46s vs 167.89s, pass rates 77.3% vs 81.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#65
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
~$0.287
क्रमांक
#62
एकूण आउटपुट टोकन्स
249,808
प्रतिसाद वेळ (सरासरी)
73.46s
एकूण खर्च
$1.713
शिफारस केलेले मॉडेल Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 6.0x less than Grok 4.6 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14 Grok 4.6 Grok 4.6 medium प्रकाशन: 2026-08-12
स्कोअर 8.4 8.4
क्रमांक #65 #62
विश्वसनीयता 9.6 10.0
सुसंगतता 9.2 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 77.3% 81.8%
अस्थिर चाचण्या 2 4
एकूण रन 66 66
प्रति निकाल खर्च ~1.792 10.703
एकूण खर्च ~$0.287 $1.713
इनपुट किंमत लागू नाही $2.000 / 1M
आउटपुट किंमत लागू नाही $6.000 / 1M
एकूण इनपुट टोकन्स 100,179 106,787
आउटपुट टोकन्स 904 4,811
रिझनिंग टोकन्स 655,731 244,997
प्रतिसाद वेळ (सरासरी) 167.89s 73.46s
प्रतिसाद वेळ (कमाल) 640.85s 514.35s
प्रतिसाद वेळ (एकूण) 3693.54s 1616.12s
पॅरामीटर्स 27.3B ~1.7T एकूण (~170B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 Qwen3.8 27B

high
खर्च
~$0.008
वेळ
270.1s
टोकन्स
18,963 tok

#62 SpaceXAI: Grok 4.6

medium
खर्च
$0.028
वेळ
72.1s
टोकन्स
4,771 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

झटपट तुलना

तुलना जोडी बदला

GPT-5.2mediumvsQwen3.8 27BhighQwen3.8 27BhighvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowGPT-6 SollowvsQwen3.8 27BhighMuse Spark 1.2lowvsGrok 4.6mediumDeepSeek V4.1 FlashhighvsGrok 4.6mediumDeepSeek V4.1 FlashlowvsGrok 4.6mediumQwen3.8 27BhighvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighGPT-6 SollowvsGrok 4.6mediumInkling SmallhighvsGrok 4.6medium