नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.8 27B (high) vs Grok 4.6 (medium)

average score जवळपास समान आहे: 8.4 vs 8.4. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Grok 4.6 (medium) वेगवान आहे: 73.46s vs 167.89s, pass rates 77.3% vs 81.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#42
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
लागू नाही
क्रमांक
#39
एकूण आउटपुट टोकन्स
249,808
प्रतिसाद वेळ (सरासरी)
73.46s
एकूण खर्च
$1.713
शिफारस केलेले मॉडेल Grok 4.6 (medium)

It has the best score here (8.4), while responding about 2.3x faster than Qwen3.8 27B (high).

तपशीलवार तुलना

मेट्रिक Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14 Grok 4.6 Grok 4.6 medium प्रकाशन: 2026-08-12
स्कोअर 8.4 8.4
क्रमांक #42 #39
विश्वसनीयता 9.6 10.0
सुसंगतता 9.2 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 77.3% 81.8%
अस्थिर चाचण्या 2 4
एकूण रन 66 66
प्रति निकाल खर्च लागू नाही 10.703
एकूण खर्च लागू नाही $1.713
इनपुट किंमत लागू नाही $2.000 / 1M
आउटपुट किंमत लागू नाही $6.000 / 1M
एकूण इनपुट टोकन्स 100,179 106,787
आउटपुट टोकन्स 904 4,811
रिझनिंग टोकन्स 655,731 244,997
प्रतिसाद वेळ (सरासरी) 167.89s 73.46s
प्रतिसाद वेळ (कमाल) 640.85s 514.35s
प्रतिसाद वेळ (एकूण) 3693.54s 1616.12s
पॅरामीटर्स 27.3B ~1.7T एकूण (~170B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
खर्च
लागू नाही
वेळ
270.1s
टोकन्स
18,963 tok

#39 SpaceXAI: Grok 4.6

medium
खर्च
$0.028
वेळ
72.1s
टोकन्स
4,771 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

झटपट तुलना

तुलना जोडी बदला

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowMuse Spark 1.2lowvsGrok 4.6mediumInkling SmallhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumMuse Spark 1.1lowvsQwen3.8 27BhighQwen3.8 MaxlowvsGrok 4.6mediumMuse Spark 1.1lowvsGrok 4.6mediumGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh