नेविगेशन
Advertise here

GPT-6 Sol (low) vs Grok 4.5 (medium)

Grok 4.5 (medium) average score में आगे है: 8.5 vs 8.4. GPT-6 Sol (low) की benchmark लागत कम है: $0.273 vs $2.042. GPT-6 Sol (low) तेज है: 6.92s vs 68.59s, pass rates 86.4% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#68
कुल आउटपुट टोकन
11,677
प्रतिक्रिया समय (औसत)
6.92s
कुल लागत
$0.273
रैंक
#60
कुल आउटपुट टोकन
299,460
प्रतिक्रिया समय (औसत)
68.59s
कुल लागत
$2.042
अनुशंसित मॉडल GPT-6 Sol (low)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 7.5x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Sol GPT-6 Sol low रिलीज़: 2026-09-23 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.4 8.5
रैंक #68 #60
विश्वसनीयता 10.0 10.0
संगति 8.5 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 83.3%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 1.604 12.007
कुल लागत $0.273 $2.042
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 77,882 122,155
आउटपुट टोकन 4,047 5,514
रीजनिंग टोकन 7,630 293,946
प्रतिक्रिया समय (औसत) 6.92s 68.59s
प्रतिक्रिया समय (अधिकतम) 17.91s 436.38s
प्रतिक्रिया समय (कुल) 152.17s 1508.91s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 GPT-6 Sol

low
लागत
$0.018
समय
17.4s
टोकन
1,850 tok

#60 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Sol 6.2 4.8 66.7% 2 8.74s 7,302 405 1,296
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें