नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 9.2. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.971 vs $2.835. GPT-5.6 Sol (low) तेज है: 8.79s vs 20.44s, pass rates 84.9% vs 86.4%.

अनुशंसित मॉडलGPT-5.6 Sol (low)It has the best score here (9.5), while costing about 2.9x less than Claude Opus 5 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 9.2 9.5
रैंक #11 #5
विश्वसनीयता 10.0 10.0
संगति 9.6 9.2
सही परीक्षण
प्रति प्रयास पास दर 84.9% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 15.747 5.391
कुल लागत $2.835 $0.971
इनपुट कीमत $5.000 / 1M $5.000 / 1M
आउटपुट कीमत $25.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 135,959 78,571
आउटपुट टोकन 67,066 4,476
रीजनिंग टोकन 19,114 14,770
प्रतिक्रिया समय (औसत) 20.44s 8.79s
प्रतिक्रिया समय (अधिकतम) 159.01s 53.91s
प्रतिक्रिया समय (कुल) 449.68s 193.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#5 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें