नेव्हिगेशन
Advertise here

GPT-5.2 (medium) vs Qwen3.8 MAX (low)

Qwen3.8 MAX (low) average score मध्ये पुढे आहे: 8.8 vs 8.7. Qwen3.8 MAX (low) चा benchmark खर्च कमी आहे: $1.089 vs $1.558. Qwen3.8 MAX (low) वेगवान आहे: 25.09s vs 31.29s, pass rates 73.9% vs 81.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-02

तुलना केलेली मॉडेल्स

क्रमांक
#54
एकूण आउटपुट टोकन्स
80,538
प्रतिसाद वेळ (सरासरी)
31.29s
एकूण खर्च
$1.558
क्रमांक
#49
एकूण आउटपुट टोकन्स
93,936
प्रतिसाद वेळ (सरासरी)
25.09s
एकूण खर्च
$1.089
शिफारस केलेले मॉडेल Qwen3.8 MAX (low)

It has the strongest score in this comparison (8.8) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक GPT-5.2 GPT-5.2 medium प्रकाशन: 2025-12-11 Qwen3.8 MAX Qwen3.8 MAX low प्रकाशन: 2026-08-04
स्कोअर 8.7 8.8
क्रमांक #54 #49
विश्वसनीयता 10.0 10.0
सुसंगतता 8.5 9.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 81.2%
अस्थिर चाचण्या 4 3
एकूण रन 69 69
प्रति निकाल खर्च 10.261 5.051
एकूण खर्च $1.558 $1.089
इनपुट किंमत $1.750 / 1M $2.000 / 1M
आउटपुट किंमत $14.000 / 1M $6.000 / 1M
कॅश वाचण्याची किंमत $0.175 / 1M लागू नाही
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 235,207 262,495
आउटपुट टोकन्स 11,065 7,787
रिझनिंग टोकन्स 69,473 86,149
प्रतिसाद वेळ (सरासरी) 31.29s 25.09s
प्रतिसाद वेळ (कमाल) 116.86s 155.75s
प्रतिसाद वेळ (एकूण) 531.98s 577.14s
पॅरामीटर्स ~1.2T एकूण (~80B सक्रिय) 2.4T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 GPT-5.2

medium
खर्च
$0.047
वेळ
49.2s
टोकन्स
3,396 tok

#49 Qwen3.8 MAX

low
खर्च
$0.026
वेळ
68.5s
टोकन्स
4,280 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Qwen3.8 MAX 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

झटपट तुलना

तुलना जोडी बदला