नेविगेशन
AI BENCHY
Advertise here

तुलना किए गए मॉडल

GPT-5.6 Sol (low) vs Grok 4.6 (high) vs Claude Opus 5 (high) benchmark तुलना: GPT-5.6 Sol (low) स्कोर में 9.5 के साथ आगे है। GPT-5.6 Sol (low) विश्वसनीयता में 10.0 के साथ आगे है। GPT-5.6 Sol (low) का कुल लागत सबसे कम है: $0.971. GPT-5.6 Sol (low) 8.79s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#5
कुल आउटपुट टोकन
19,246
प्रतिक्रिया समय (औसत)
8.79s
कुल लागत
$0.971
रैंक
#11
कुल आउटपुट टोकन
265,604
प्रतिक्रिया समय (औसत)
79.38s
कुल लागत
$1.809
रैंक
#10
कुल आउटपुट टोकन
86,180
प्रतिक्रिया समय (औसत)
20.44s
कुल लागत
$2.835
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 2.4x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12 Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25
स्कोर 9.5 9.2 9.2
रैंक #5 #11 #10
विश्वसनीयता 10.0 10.0 10.0
संगति 9.2 9.6 9.6
प्रयास 66/66 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 84.9% 84.9%
अस्थिर टेस्ट 2 1 1
कुल रन 66 66 66
प्रति परिणाम लागत 5.391 10.046 15.747
कुल लागत $0.971 $1.809 $2.835
इनपुट कीमत $5.000 / 1M $2.000 / 1M $5.000 / 1M
आउटपुट कीमत $30.000 / 1M $6.000 / 1M $25.000 / 1M
कुल इनपुट टोकन 78,571 107,266 135,959
आउटपुट टोकन 4,476 5,094 67,066
रीजनिंग टोकन 14,770 260,510 19,114
प्रतिक्रिया समय (औसत) 8.79s 79.38s 20.44s
प्रतिक्रिया समय (अधिकतम) 53.91s 618.49s 159.01s
प्रतिक्रिया समय (कुल) 193.33s 1746.29s 449.68s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय) ~5T कुल (~500B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#5 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

#11 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

#10 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721

त्वरित तुलना

तुलना जोड़ी बदलें