नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (high) average score मध्ये पुढे आहे: 9.4 vs 9.2. GPT-5.6 Sol (high) चा benchmark खर्च कमी आहे: $1.234 vs $1.486. Claude Opus 5 (medium) वेगवान आहे: 9.38s vs 11.73s, pass rates 83.3% vs 89.4%.

शिफारस केलेले मॉडेलGPT-5.6 Sol (high)It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 medium प्रकाशन: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol high प्रकाशन: 2026-07-09
स्कोअर 9.2 9.4
क्रमांक #12 #8
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 89.4%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 8.253 6.852
एकूण खर्च $1.486 $1.234
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,607 79,249
आउटपुट टोकन्स 25,673 4,855
रिझनिंग टोकन्स 6,930 23,044
प्रतिसाद वेळ (सरासरी) 9.38s 11.73s
प्रतिसाद वेळ (कमाल) 35.05s 54.79s
प्रतिसाद वेळ (एकूण) 206.26s 257.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
खर्च
$0.125
वेळ
69.3s
टोकन्स
5,134 tok

#8 GPT-5.6 Sol

high
खर्च
$0.151
वेळ
201.9s
टोकन्स
5,100 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

झटपट तुलना

तुलना जोडी बदला