नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.3 Chat

सारांश

Claude Sonnet 4.6 vs GPT-5.3 Chat benchmark तुलना: Claude Sonnet 4.6 average score मध्ये पुढे आहे: 7.8 vs 7.5. GPT-5.3 Chat चा benchmark खर्च कमी आहे: $0.433 vs $1.418. GPT-5.3 Chat वेगवान आहे: 6.34s vs 17.06s, pass rates 65.1% vs 66.7%.

शिफारस केलेले मॉडेल: GPT-5.3 Chat - Its score stays close to the best score here (7.5 vs 7.8), while costing about 3.3x less than Claude Sonnet 4.6.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-12

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 medium प्रकाशन: 2026-02-17 GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03
स्कोअर 7.8 7.5
क्रमांक #34 #47
विश्वसनीयता 10.0 10.0
सुसंगतता 9.1 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.1% 66.7%
अस्थिर चाचण्या 2 5
एकूण रन 63 63
प्रति निकाल खर्च 10.904 3.605
एकूण खर्च $1.418 $0.433
इनपुट किंमत $3.000 / 1M $1.750 / 1M
आउटपुट किंमत $15.000 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 49,112 34,209
आउटपुट टोकन्स 54,703 26,617
रिझनिंग टोकन्स 29,970 0
प्रतिसाद वेळ (सरासरी) 17.06s 6.34s
प्रतिसाद वेळ (कमाल) 46.35s 18.33s
प्रतिसाद वेळ (एकूण) 221.83s 133.13s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Claude Sonnet 4.6

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#47 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 789 1,046 1,093
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 18,351 5,871 3,962
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 8,676 649 742
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 471 25,790 16,919
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 564 256 433
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 792 318 552
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 5.31s 816 592 646
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 11,454 655 351
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 204 3,437 1,586
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

झटपट तुलना

तुलना जोडी बदला