नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (medium) average score मध्ये पुढे आहे: 9.4 vs 9.2. GPT-5.6 Sol (medium) चा benchmark खर्च कमी आहे: $1.316 vs $1.486. Claude Opus 5 (medium) वेगवान आहे: 9.38s vs 11.35s, pass rates 83.3% vs 90.9%.

शिफारस केलेले मॉडेलGPT-5.6 Sol (medium)It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 medium प्रकाशन: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol medium प्रकाशन: 2026-07-09
स्कोअर 9.2 9.4
क्रमांक #12 #7
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 90.9%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 8.253 7.311
एकूण खर्च $1.486 $1.316
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,607 78,997
आउटपुट टोकन्स 25,673 4,696
रिझनिंग टोकन्स 6,930 26,002
प्रतिसाद वेळ (सरासरी) 9.38s 11.35s
प्रतिसाद वेळ (कमाल) 35.05s 79.40s
प्रतिसाद वेळ (एकूण) 206.26s 249.73s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
खर्च
$0.125
वेळ
69.3s
टोकन्स
5,134 tok

#7 GPT-5.6 Sol

medium
खर्च
$0.124
वेळ
57.2s
टोकन्स
4,199 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

झटपट तुलना

तुलना जोडी बदला