नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.2

सारांश

Claude Sonnet 4.6 vs GPT-5.2 benchmark तुलना: GPT-5.2 average score मध्ये पुढे आहे: 8.4 vs 7.3. Claude Sonnet 4.6 चा benchmark खर्च कमी आहे: $0.316 vs $0.548. Claude Sonnet 4.6 वेगवान आहे: 5.04s vs 16.88s, pass rates 55.6% vs 71.4%.

शिफारस केलेले मॉडेल: GPT-5.2 - It has the strongest score in this comparison (8.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-02

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none प्रकाशन: 2026-02-17 GPT-5.2 GPT-5.2 medium प्रकाशन: 2025-12-11
स्कोअर 7.3 8.4
क्रमांक #57 #22
विश्वसनीयता 10.0 10.0
सुसंगतता 9.7 8.4
बरोबर चाचण्या
प्रति प्रयत्न पास दर 55.6% 71.4%
अस्थिर चाचण्या 1 4
एकूण रन 63 63
प्रति निकाल खर्च 2.870 4.209
एकूण खर्च $0.316 $0.548
इनपुट किंमत $3.000 / 1M $1.750 / 1M
आउटपुट किंमत $15.000 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 57,886 33,967
आउटपुट टोकन्स 9,465 2,901
रिझनिंग टोकन्स 0 31,932
प्रतिसाद वेळ (सरासरी) 5.04s 16.88s
प्रतिसाद वेळ (कमाल) 23.84s 77.80s
प्रतिसाद वेळ (एकूण) 70.60s 236.34s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 Claude Sonnet 4.6

none
खर्च
$0.038
वेळ
27.3s
टोकन्स
2,598 tok

#22 GPT-5.2

medium
खर्च
$0.047
वेळ
49.2s
टोकन्स
3,396 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 636 1,214 0
GPT-5.2 6.5 8.0 58.3% 1 7.81s 606 567 2,002
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 26,024 3,766 0
GPT-5.2 10.0 10.0 100.0% 0 14.06s 11,019 291 1,757
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 8,574 252 0
GPT-5.2 10.0 10.0 100.0% 0 3.15s 7,140 234 420
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 759 413 0
GPT-5.2 5.9 7.2 55.6% 1 77.80s 473 42 10,342
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 513 192 0
GPT-5.2 3.7 9.7 0.0% 0 4.32s 477 162 269
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 690 90 0
GPT-5.2 9.9 10.0 100.0% 0 3.12s 660 94 614
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 663 533 0
GPT-5.2 7.5 7.3 77.8% 1 5.80s 642 735 924
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 11,301 447 0
GPT-5.2 4.7 1.6 66.7% 1 10.30s 5,453 239 469
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 204 431 0
GPT-5.2 3.0 10.0 0.0% 0 28.18s 195 26 3,223

झटपट तुलना

तुलना जोडी बदला