नेव्हिगेशन
Advertise here

GPT-6 Sol (low) vs Qwen3.8 27B (high)

average score जवळपास समान आहे: 8.4 vs 8.4. GPT-6 Sol (low) चा benchmark खर्च कमी आहे: $0.273 vs ~$0.287. GPT-6 Sol (low) वेगवान आहे: 6.92s vs 167.89s, pass rates 86.4% vs 77.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#68
एकूण आउटपुट टोकन्स
11,677
प्रतिसाद वेळ (सरासरी)
6.92s
एकूण खर्च
$0.273
क्रमांक
#65
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
~$0.287
शिफारस केलेले मॉडेल GPT-6 Sol (low)

It has the best score here (8.4), while responding about 24.3x faster than Qwen3.8 27B (high).

तपशीलवार तुलना

मेट्रिक GPT-6 Sol GPT-6 Sol low प्रकाशन: 2026-09-23 Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14
स्कोअर 8.4 8.4
क्रमांक #68 #65
विश्वसनीयता 10.0 9.6
सुसंगतता 8.5 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 77.3%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 1.604 ~1.792
एकूण खर्च $0.273 ~$0.287
इनपुट किंमत $2.000 / 1M लागू नाही
आउटपुट किंमत $10.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 77,882 100,179
आउटपुट टोकन्स 4,047 904
रिझनिंग टोकन्स 7,630 655,731
प्रतिसाद वेळ (सरासरी) 6.92s 167.89s
प्रतिसाद वेळ (कमाल) 17.91s 640.85s
प्रतिसाद वेळ (एकूण) 152.17s 3693.54s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 GPT-6 Sol

low
खर्च
$0.018
वेळ
17.4s
टोकन्स
1,850 tok

#65 Qwen3.8 27B

high
खर्च
~$0.008
वेळ
270.1s
टोकन्स
18,963 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Sol 6.2 4.8 66.7% 2 8.74s 7,302 405 1,296
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

झटपट तुलना

तुलना जोडी बदला

GPT-6 SollowvsInkling SmallhighGPT-5.2mediumvsQwen3.8 27BhighQwen3.8 27BhighvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsGPT-6 SollowGPT-6 SollowvsMiMo-V2.6-PromediumQwen3.8 27BhighvsGrok 4.5lowGPT-6 SollowvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-6 SollowQwen3.8 27BhighvsGLM 5.3 FlashXmaxQwen3.8 27BhighvsGrok 4.6mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhigh