नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (high) average score मध्ये पुढे आहे: 9.4 vs 9.2. GPT-5.6 Sol (high) चा benchmark खर्च कमी आहे: $1.234 vs $2.835. GPT-5.6 Sol (high) वेगवान आहे: 11.73s vs 20.44s, pass rates 84.9% vs 89.4%.

शिफारस केलेले मॉडेलGPT-5.6 Sol (high)It has the best score here (9.4), while costing about 2.3x less than Claude Opus 5 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol high प्रकाशन: 2026-07-09
स्कोअर 9.2 9.4
क्रमांक #11 #8
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 89.4%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 15.747 6.852
एकूण खर्च $2.835 $1.234
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,959 79,249
आउटपुट टोकन्स 67,066 4,855
रिझनिंग टोकन्स 19,114 23,044
प्रतिसाद वेळ (सरासरी) 20.44s 11.73s
प्रतिसाद वेळ (कमाल) 159.01s 54.79s
प्रतिसाद वेळ (एकूण) 449.68s 257.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

#8 GPT-5.6 Sol

high
खर्च
$0.151
वेळ
201.9s
टोकन्स
5,100 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

झटपट तुलना

तुलना जोडी बदला