नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.5-27B

सारांश

GPT-5.3 Chat vs Qwen3.5-27B benchmark तुलना: Qwen3.5-27B average score मध्ये पुढे आहे: 7.9 vs 7.5. GPT-5.3 Chat चा benchmark खर्च कमी आहे: $0.433 vs $0.536. GPT-5.3 Chat वेगवान आहे: 6.34s vs 68.39s, pass rates 66.7% vs 73.0%.

शिफारस केलेले मॉडेल: GPT-5.3 Chat - Its score stays close to the best score here (7.5 vs 7.9), while responding about 10.8x faster than Qwen3.5-27B.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-17

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 7.5 7.9
क्रमांक #45 #29
विश्वसनीयता 10.0 10.0
सुसंगतता 8.1 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 73.0%
अस्थिर चाचण्या 5 4
एकूण रन 63 63
प्रति निकाल खर्च 3.605 4.901
एकूण खर्च $0.433 $0.536
इनपुट किंमत $1.750 / 1M $0.195 / 1M
आउटपुट किंमत $14.000 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 34,209 42,164
आउटपुट टोकन्स 26,617 8,534
रिझनिंग टोकन्स 0 329,289
प्रतिसाद वेळ (सरासरी) 6.34s 68.39s
प्रतिसाद वेळ (कमाल) 18.33s 234.36s
प्रतिसाद वेळ (एकूण) 133.13s 1436.24s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

#29 Qwen3.5-27B

medium
Cost
$0.008
Time
62.0s
Tokens
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683

झटपट तुलना

तुलना जोडी बदला