नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (medium) average score मध्ये पुढे आहे: 9.4 vs 9.2. GPT-5.6 Sol (medium) चा benchmark खर्च कमी आहे: $1.316 vs $2.835. GPT-5.6 Sol (medium) वेगवान आहे: 11.35s vs 20.44s, pass rates 84.9% vs 90.9%.

शिफारस केलेले मॉडेलGPT-5.6 Sol (medium)It has the best score here (9.4), while costing about 2.2x less than Claude Opus 5 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol medium प्रकाशन: 2026-07-09
स्कोअर 9.2 9.4
क्रमांक #11 #7
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 90.9%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 15.747 7.311
एकूण खर्च $2.835 $1.316
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,959 78,997
आउटपुट टोकन्स 67,066 4,696
रिझनिंग टोकन्स 19,114 26,002
प्रतिसाद वेळ (सरासरी) 20.44s 11.35s
प्रतिसाद वेळ (कमाल) 159.01s 79.40s
प्रतिसाद वेळ (एकूण) 449.68s 249.73s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

#7 GPT-5.6 Sol

medium
खर्च
$0.124
वेळ
57.2s
टोकन्स
4,199 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

झटपट तुलना

तुलना जोडी बदला