नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Qwen3.8 27B (high)

average score जवळपास समान आहे: 8.4 vs 8.4. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. GPT-5.2 (medium) वेगवान आहे: 28.51s vs 167.89s, pass rates 72.7% vs 77.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#41
एकूण आउटपुट टोकन्स
71,252
प्रतिसाद वेळ (सरासरी)
28.51s
एकूण खर्च
$1.182
क्रमांक
#42
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल GPT-5.2 (medium)

It has the best score here (8.4), while responding about 5.9x faster than Qwen3.8 27B (high).

तपशीलवार तुलना

मेट्रिक GPT-5.2 GPT-5.2 medium प्रकाशन: 2025-12-11 Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14
स्कोअर 8.4 8.4
क्रमांक #41 #42
विश्वसनीयता 10.0 9.6
सुसंगतता 8.5 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.7% 77.3%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 8.438 लागू नाही
एकूण खर्च $1.182 लागू नाही
इनपुट किंमत $1.750 / 1M लागू नाही
आउटपुट किंमत $14.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 105,013 100,179
आउटपुट टोकन्स 9,914 904
रिझनिंग टोकन्स 61,338 655,731
प्रतिसाद वेळ (सरासरी) 28.51s 167.89s
प्रतिसाद वेळ (कमाल) 116.86s 640.85s
प्रतिसाद वेळ (एकूण) 456.13s 3693.54s
पॅरामीटर्स ~1.2T एकूण (~80B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 GPT-5.2

medium
खर्च
$0.047
वेळ
49.2s
टोकन्स
3,396 tok

#42 Qwen3.8 27B

high
खर्च
लागू नाही
वेळ
270.1s
टोकन्स
18,963 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

झटपट तुलना

तुलना जोडी बदला

Seed 2.1 TurbomediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowGPT-5.2mediumvsInkling SmallhighQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsGPT-5.2mediumMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumMuse Spark 1.1lowvsQwen3.8 27BhighMuse Spark 1.1lowvsGPT-5.2mediumGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh