नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.6 Flash

सारांश

GPT-5.3 Chat vs Qwen3.6 Flash benchmark तुलना: Qwen3.6 Flash average score मध्ये पुढे आहे: 7.5 vs 7.2. Qwen3.6 Flash चा benchmark खर्च कमी आहे: $0.288 vs $0.433. GPT-5.3 Chat वेगवान आहे: 6.34s vs 19.25s, pass rates 66.7% vs 71.4%.

शिफारस केलेले मॉडेल: GPT-5.3 Chat - Its score stays close to the best score here (7.2 vs 7.5), while responding about 3.0x faster than Qwen3.6 Flash.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-10

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03 Qwen3.6 Flash Qwen3.6 Flash medium प्रकाशन: 2026-04-20
स्कोअर 7.2 7.5
क्रमांक #64 #40
विश्वसनीयता 10.0 10.0
सुसंगतता 8.1 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 66.7% 71.4%
अस्थिर चाचण्या 5 5
एकूण रन 63 63
प्रति निकाल खर्च 3.605 3.030
एकूण खर्च $0.433 $0.288
इनपुट किंमत $1.750 / 1M $0.188 / 1M
आउटपुट किंमत $14.000 / 1M $1.125 / 1M
एकूण इनपुट टोकन्स 34,209 42,362
आउटपुट टोकन्स 26,617 2,995
रिझनिंग टोकन्स 0 245,358
प्रतिसाद वेळ (सरासरी) 6.34s 19.25s
प्रतिसाद वेळ (कमाल) 18.33s 122.87s
प्रतिसाद वेळ (एकूण) 133.13s 404.20s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

#40 Qwen3.6 Flash

medium
Invalid SVG
Cost
$0.008
Time
29.9s
Tokens
6,784 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 672 624 14,024
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.6 Flash 5.0 5.1 44.5% 2 42.85s 7,895 495 67,967
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 14,934 483 13,839
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 7,782 270 13,155
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 771 60 24,409
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 516 140 5,445
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 699 102 7,423
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.29s 696 460 10,860
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 8,193 335 1,188
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0
Qwen3.6 Flash 3.0 10.0 0.0% 0 122.87s 204 26 87,048

झटपट तुलना

तुलना जोडी बदला