नेव्हिगेशन
Advertise here

GPT 5.3 Chat vs Qwen3.5-27B (medium)

average score जवळपास समान आहे: 7.5 vs 7.5. GPT 5.3 Chat चा benchmark खर्च कमी आहे: $0.533 vs $0.982. GPT 5.3 Chat वेगवान आहे: 6.56s vs 113.28s, pass rates 65.2% vs 75.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#122
एकूण आउटपुट टोकन्स
28,179
प्रतिसाद वेळ (सरासरी)
6.56s
एकूण खर्च
$0.533
क्रमांक
#124
एकूण आउटपुट टोकन्स
614,909
प्रतिसाद वेळ (सरासरी)
113.28s
एकूण खर्च
$0.982
शिफारस केलेले मॉडेल GPT 5.3 Chat

It has the best score here (7.5), while costing about 1.8x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat none प्रकाशन: 2026-03-03 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 7.5 7.5
क्रमांक #122 #124
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 7.8
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 75.8%
अस्थिर चाचण्या 4 6
एकूण रन 66 66
प्रति निकाल खर्च 4.097 8.217
एकूण खर्च $0.533 $0.982
इनपुट किंमत $1.750 / 1M $0.195 / 1M
आउटपुट किंमत $14.000 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 78,846 111,644
आउटपुट टोकन्स 28,179 16,113
रिझनिंग टोकन्स 0 598,796
प्रतिसाद वेळ (सरासरी) 6.56s 113.28s
प्रतिसाद वेळ (कमाल) 18.33s 1026.43s
प्रतिसाद वेळ (एकूण) 137.77s 2492.26s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT 5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

#124 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

झटपट तुलना

तुलना जोडी बदला