नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.3 Chat vs Qwen3.5-27B (medium)

GPT-5.3 Chat average score मध्ये पुढे आहे: 7.5 vs 7.4. GPT-5.3 Chat चा benchmark खर्च कमी आहे: $0.571 vs $0.981. GPT-5.3 Chat वेगवान आहे: 6.88s vs 111.94s, pass rates 68.2% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-12

क्रमांक
#81
एकूण आउटपुट टोकन्स
30,854
प्रतिसाद वेळ (सरासरी)
6.88s
एकूण खर्च
$0.571
क्रमांक
#86
एकूण आउटपुट टोकन्स
614,429
प्रतिसाद वेळ (सरासरी)
111.94s
एकूण खर्च
$0.981
शिफारस केलेले मॉडेल GPT-5.3 Chat

It has the best score here (7.5), while costing about 1.7x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 7.5 7.4
क्रमांक #81 #86
विश्वसनीयता 10.0 10.0
सुसंगतता 8.2 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 72.7%
अस्थिर चाचण्या 5 5
एकूण रन 66 66
प्रति निकाल खर्च 4.387 8.324
एकूण खर्च $0.571 $0.981
इनपुट किंमत $1.750 / 1M $0.195 / 1M
आउटपुट किंमत $14.000 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 78,990 111,635
आउटपुट टोकन्स 30,854 15,999
रिझनिंग टोकन्स 0 598,430
प्रतिसाद वेळ (सरासरी) 6.88s 111.94s
प्रतिसाद वेळ (कमाल) 18.33s 1026.43s
प्रतिसाद वेळ (एकूण) 151.31s 2462.67s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 GPT-5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

#86 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

झटपट तुलना

तुलना जोडी बदला