नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (low) average score मध्ये पुढे आहे: 9.5 vs 9.2. GPT-5.6 Sol (low) चा benchmark खर्च कमी आहे: $0.971 vs $2.835. GPT-5.6 Sol (low) वेगवान आहे: 8.79s vs 20.44s, pass rates 84.9% vs 86.4%.

शिफारस केलेले मॉडेलGPT-5.6 Sol (low)It has the best score here (9.5), while costing about 2.9x less than Claude Opus 5 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol low प्रकाशन: 2026-07-09
स्कोअर 9.2 9.5
क्रमांक #11 #5
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 86.4%
अस्थिर चाचण्या 1 2
एकूण रन 66 66
प्रति निकाल खर्च 15.747 5.391
एकूण खर्च $2.835 $0.971
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,959 78,571
आउटपुट टोकन्स 67,066 4,476
रिझनिंग टोकन्स 19,114 14,770
प्रतिसाद वेळ (सरासरी) 20.44s 8.79s
प्रतिसाद वेळ (कमाल) 159.01s 53.91s
प्रतिसाद वेळ (एकूण) 449.68s 193.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

#5 GPT-5.6 Sol

low
खर्च
$0.062
वेळ
26.7s
टोकन्स
2,150 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

झटपट तुलना

तुलना जोडी बदला